שיתוף | מה חדש בבינה מלאכותית - מתעדכן
-
לא ראיתי אם כבר פרסמו, אמחק. לא מוצא תיעוד ברור.
אבל חידוש בג'מיני.
נעים להכיר: Gemini Sparkבטא
אתה יכול להגדיר פעולות אוטומטיות באימייל, בקבצים, באתרים ועוד. ככל שיותר משימות יעברו ל-Gemini, הוא ילמד את המטרות שלך.
איך זה עובד
Spark משתמש במידע שלך ממקורות כמו אפליקציות מקושרות, "AI מותאם אישית", אתרים שנכנסת אליהם, המיקום שלך ועודהקישור ייפתח בחלון חדש. כדי לעבוד, הוא משתף מידע חיוני עם צדדים שלישיים. זה יכול לכלול את השם שלך, פרטים ליצירת קשר, קבצים, העדפות ועוד פרטים שיכולים להיות רגישים לדעתך.
Gemini שומר נתוני דפדפן מרוחק, כמו פרטי התחברות ונתוני הרצה מרחוק של קוד. אתה יכול למחוק את הנתונים האלה ולהשבית את האפליקציות המקושרות או את ה-AI המותאם אישית בהגדרות. אתה יכול גם לנהל ולמחוק את הפעילות שלך ב"פעילות בממשקי Gemini". מידע על האפשרויות שלךהקישור ייפתח בחלון חדש
Spark הוא שירות ניסיוני
הוא אמור לבקש ממך אישור לפני ביצוע פעולות רגישות, אבל הוא עלול למשל לשתף את המידע שלך או לבצע רכישות בלי לבקש אישור.
חשוב שתפקח על הפעילות שלו ואל תסתמך עליו לקבלת ייעוץ רפואי, משפטי או פיננסי, או עזרה מקצועית בתחום אחר. עיין בסיכוניםהקישור ייפתח בחלון חדש
השימוש כפוף לתנאים של Googleהקישור ייפתח בחלון חדש, למדיניות השימושהקישור ייפתח בחלון חדש ולהודעת הפרטיות של ממשקי Geminiג'מיני ממש מדבר שטויות בחודשיים האחרונים.
-
לא ראיתי אם כבר פרסמו, אמחק. לא מוצא תיעוד ברור.
אבל חידוש בג'מיני.
נעים להכיר: Gemini Sparkבטא
אתה יכול להגדיר פעולות אוטומטיות באימייל, בקבצים, באתרים ועוד. ככל שיותר משימות יעברו ל-Gemini, הוא ילמד את המטרות שלך.
איך זה עובד
Spark משתמש במידע שלך ממקורות כמו אפליקציות מקושרות, "AI מותאם אישית", אתרים שנכנסת אליהם, המיקום שלך ועודהקישור ייפתח בחלון חדש. כדי לעבוד, הוא משתף מידע חיוני עם צדדים שלישיים. זה יכול לכלול את השם שלך, פרטים ליצירת קשר, קבצים, העדפות ועוד פרטים שיכולים להיות רגישים לדעתך.
Gemini שומר נתוני דפדפן מרוחק, כמו פרטי התחברות ונתוני הרצה מרחוק של קוד. אתה יכול למחוק את הנתונים האלה ולהשבית את האפליקציות המקושרות או את ה-AI המותאם אישית בהגדרות. אתה יכול גם לנהל ולמחוק את הפעילות שלך ב"פעילות בממשקי Gemini". מידע על האפשרויות שלךהקישור ייפתח בחלון חדש
Spark הוא שירות ניסיוני
הוא אמור לבקש ממך אישור לפני ביצוע פעולות רגישות, אבל הוא עלול למשל לשתף את המידע שלך או לבצע רכישות בלי לבקש אישור.
חשוב שתפקח על הפעילות שלו ואל תסתמך עליו לקבלת ייעוץ רפואי, משפטי או פיננסי, או עזרה מקצועית בתחום אחר. עיין בסיכוניםהקישור ייפתח בחלון חדש
השימוש כפוף לתנאים של Googleהקישור ייפתח בחלון חדש, למדיניות השימושהקישור ייפתח בחלון חדש ולהודעת הפרטיות של ממשקי Geminiג'מיני ממש מדבר שטויות בחודשיים האחרונים.
-
לא ראיתי אם כבר פרסמו, אמחק. לא מוצא תיעוד ברור.
אבל חידוש בג'מיני.
נעים להכיר: Gemini Sparkבטא
אתה יכול להגדיר פעולות אוטומטיות באימייל, בקבצים, באתרים ועוד. ככל שיותר משימות יעברו ל-Gemini, הוא ילמד את המטרות שלך.
איך זה עובד
Spark משתמש במידע שלך ממקורות כמו אפליקציות מקושרות, "AI מותאם אישית", אתרים שנכנסת אליהם, המיקום שלך ועודהקישור ייפתח בחלון חדש. כדי לעבוד, הוא משתף מידע חיוני עם צדדים שלישיים. זה יכול לכלול את השם שלך, פרטים ליצירת קשר, קבצים, העדפות ועוד פרטים שיכולים להיות רגישים לדעתך.
Gemini שומר נתוני דפדפן מרוחק, כמו פרטי התחברות ונתוני הרצה מרחוק של קוד. אתה יכול למחוק את הנתונים האלה ולהשבית את האפליקציות המקושרות או את ה-AI המותאם אישית בהגדרות. אתה יכול גם לנהל ולמחוק את הפעילות שלך ב"פעילות בממשקי Gemini". מידע על האפשרויות שלךהקישור ייפתח בחלון חדש
Spark הוא שירות ניסיוני
הוא אמור לבקש ממך אישור לפני ביצוע פעולות רגישות, אבל הוא עלול למשל לשתף את המידע שלך או לבצע רכישות בלי לבקש אישור.
חשוב שתפקח על הפעילות שלו ואל תסתמך עליו לקבלת ייעוץ רפואי, משפטי או פיננסי, או עזרה מקצועית בתחום אחר. עיין בסיכוניםהקישור ייפתח בחלון חדש
השימוש כפוף לתנאים של Googleהקישור ייפתח בחלון חדש, למדיניות השימושהקישור ייפתח בחלון חדש ולהודעת הפרטיות של ממשקי Geminiג'מיני ממש מדבר שטויות בחודשיים האחרונים.
-
חברה לא לפרסם פוסטים כאן שהם לא מוגדרים כעדכוני חדשות בעולם הAI בבקשה לכבד!
-
בשורה למשתמשי קודקס: קודקס תומך באופן רשמי החל מהיום בעברית מימין לשמאל בצורה מלאה!
נדרש רק לעדכן גרסה. תהנו!@יענקלה-AI
כנ"ל, כמובן, GPT בweb. -
טיקטוק השיקה את מודל הוידאו המתקדם בעולם SeeDance 2.5
כרגע זמין רק דרך Dreamina. בקרוב יצא גם API.מה חדש:
· סרטונים מקוריים של 30 שניות בדור אחד
· חוויית עריכה אינטראקטיבית חדשה: עיצוב מחדש של כל חלק מהמסגרת
· מצב וידאו ארוך: עד 3 דקות, עם עקביות שמחזיקה לאורך כל הסרטון.
· עד 50 הפניות רב-מודליות, כולל כעת תמיכה במודלים לבנים תלת-ממדיים ותיעוד מסך ירוק — מביא את יצירת ה-AI לתוך זרימות עבודה אמיתיות של הפקה
· תאורה וצללים קרובים יותר לחיים, פרטי תנועה עשירים יותר, ושליטה מדויקת בפרמטר זמן עד לשנייה אחתבמקביל מבצע מטורףףףף עכשיו בהיגספיילד ברכישת מנוי פלוס שעכשיו בהנחה עולה 30 דולר לחודש - מקבלים שבועיים שלמים ללא הגבלה בסידאנס 2. ובנוסף שבוע אחד של סידאנס 2 באיכות 4k לללא הגבלה בחינםםם!! מי שקצת מכיר את התחום יודע שהמודל באיכות 4k יקר בטירוףף - אז רוצו לקנות!
-
הרגע שבו נמאס לבנ"א מכמויות הראם של הai.
אז הוא נתן לו תקציב של שני ג'יגה.
פשוט תקראו את הרדמי ותהנו.https://github.com/drumih/turbo-fieldfare
כמובן שזה רק למק..
-
DeepSeek - DeepSeek V4 Flash 0731
רעידת אדמה נוספת בעולם ה-AI:
DeepSeek מוציאה את מודל ה-V4 Flash שלה מתצוגה מקדימה, ומשיקה את המודל הסופי והרשמי: DeepSeek V4 Flash 0731.
המודל החדש עולה על גרסת התצוגה המקדימה של V4 Pro, ועוקף אפילו את GLM 5.2 האגדי, או לפחות משתווה לו, למרות שהוא רק כשליש מגודלו.
המודל השתפר משמעותית בכל המדדים, בפרט במשימות סוכניות, וייתכן שאנו חווים כרגע את "רגע DeepSeek 2"...


לפי DeepSeek, הם מתכננים להשיק בקרוב גם את הגרסה הרשמית של DeepSeek V4 Pro.
קישור:
https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731 -
קלוד הצליח לפרוץ בעקבות הגדרה שגוייה את הסאנדבוקס של האימון ולפרוץ בפועל לשלוש ארגונים.
https://www.geektime.co.il/anthropic-claude-cybersecurity-evals-incident/
-
קלוד הצליח לפרוץ בעקבות הגדרה שגוייה את הסאנדבוקס של האימון ולפרוץ בפועל לשלוש ארגונים.
https://www.geektime.co.il/anthropic-claude-cybersecurity-evals-incident/
@המלאך הכתבה לחסומים:
חברת אנת'רופיק פרסמה הלילה (ו') פוסט יוצא דופן בבלוג שלה, שחושף כי שלושה ממודלי קלוד שלה הצליחו לצאת מחוץ לסביבת ניסוי סגורה, ותקפו מערכות אמיתיות של שלושה ארגונים שונים במהלך 6 הרצות נפרדות. החשיפה מגיעה בעקבות תחקיר מקיף שערכה החברה על יותר מ-140 אלף ניסויים שערכה, שהגיע אחרי תקרית האבטחה הדומה של OpenAI – אם כי באנת'רופיק מדגישים כי בניגוד ל-OpenAI שם המודלים ניצלו חולשת Zero-Day כדי "לברוח" מסביבת הניסוי, כאן מדובר בכשל תפעולי בהגדרות, שהשאיר גישה פתוחה לרשת.
המודלים תקפו חברות אמיתיות
על פי אנת'רופיק, התקלה התרחשה במהלך תרגיל CTF או "תפוס את הדגל" – פרקטיקה מוכרת בתחום הסייבר, שמאתגרת משתתפים למצוא מחרוזת טקסט סודית שהוחבאה. אנת'רופיק בדקה את המודלים ויכולות הסייבר שלהם מול ממשקי API ומערכות מורכבות, כשהם הונחו במפורש לפעול כאילו אין להם חיבור לרשת. המבחנים בוצעו על גרסאות "גולמיות" של המודלים, ללא שכבות הבטיחות והמסננים הרגילים שיהיו זמינים כמובן כשיושקו, כדי למתוח את הגבולות שלהם במקרי קיצון.בפועל, הגדרה שגויה בתשתית של הבדיקות השאירה למודלים גישה פתוחה לאינטרנט. מכיוון שהמודלים הניחו שכל מה שנמצא מולם הוא חלק מסימולציית הבדיקה, הם החלו לתקוף שרתים שגילו, בלי לדעת שמדובר בשרתים של חברות אמיתיות.
במקרה החמור ביותר כנראה, נתקל מודל Claude Opus 4.7 בחברה אמיתית בעלת שם זהה לשם היעד המומצא בניסוי. המודל ניצל חולשות אבטחה בסיסיות, כמו סיסמאות חלשות ו-Endpoints ללא אימות, שלף הרשאות וקיבל גישה לדאטהבייס של החברה, שהכיל מאות רשומות מתוך סביבת הפרודקשן שלה. למרות שבשלב מסוים המודל זיהה כי מדובר במערכת אמיתית, הוא המשיך במתקפה מכיוון ש"הניח" שמדובר בחלק מובנה ומתוחכם מהאתגר ולא באג.
באירוע שני, מודל Claude Mythos 5 נתקל בהוראות פיקטיביות שהורו לו להתקין חבילת קוד שלא הייתה קיימת בספריית PyPI. המודל החליט ליזום מתקפת שרשרת אספקה מסוג Dependency Confusion, שלא היה מבייש קבוצת תקיפה צפון קוריאנית: בשלב הראשון הוא החליט ליצור בעצמו את החבילה החסרה, ולהעלות אותה למאגר הציבורי עם קוד זדוני ששתל בה, ואז הגיע הקטע המרשים.
כל מי שפתח חשבון ב-PyPI יודע שהוא צריך כתובת מייל, וכדי להשיג מייל נדרש אימות במספר טלפון שלא היה לו. המודל לא ויתר, וניסה למצוא דרכים להשיג תקציב כדי לשלם על שירות מספרי טלפון וירטואליים. כשנכשל בזה, הוא עשה "חישוב מסלול מחדש", מצא שירות מייל חינמי שלא דורש אימות טלפוני, נרשם איתו ל-PyPI והעלה את הנוזקה לרשת הפתוחה – כך שהיא הייתה זמינה לכל המשתמשים.
הנוזקה הייתה באוויר רק שעה, אבל כבר הורדה על ידי 15 מערכות אמיתיות. בין המערכות שהורידה והתקינה את החבילה הנגועה שיצר מיתוס הייתה גם, למרבה האירוניה, חברת אבטחה, שרצתה לסרוק את הקוד, אבל הקוד הזדוני של קלוד הופעל, גנב את פרטי ההזדהות של החברה ושלח אותם לשרת שהמודל הקים מראש – מה שאפשר לו לחדור לתשתיות נוספות של אותה חברה. מתיעוד ה-Reasoning של המודל, כלומר הלוג של כל ההחלטות שהוא קיבל בדרך, עולה שלמרות שהמודל חשד תחילה שמדובר במתקפה אמיתית, הוא שכנע את עצמו שהוא בסימולציה משום שלא זיהה את תעודות האבטחה, ה-CAs האמיתיות שאבטחו את התעבורה, ומכיוון שתאריך המערכת הצביע על שנת 2026.
המקרה השלישי והקל יותר הגיע ממודל מחקר פנימי, שסרק כ-9,000 יעדים ברשת ופרץ לאפליקציה שמצא באמצעות פרצת אבטחה בעמוד חשוף וקצת SQL Injection טוב. עם זאת, החדשות הטובות הן שברגע שהמודל זיהה שהשרת שייך לחשבון ענן אמיתי שאינו קשור לתרגיל, הוא עצר את המתקפה ביוזמתו.
הקשר הישראלי
חוקרי אנת'רופיק ערכו את הבדיקות בשיתוף חברת הסטארטאפ הישראלית Irregular, עליה כתבנו בעבר כאן. בחברה הסבירו כי הפעולות נבעו מתפיסה שגויה של הסיטואציה, כשהמודלים הונחו שאין להם גישה לאינטרנט וקיבלו משימה "להשיג את הדגל", בעוד שבפועל הוגדר בטעות חיבור לרשת. עם הגילוי עצרה אנת'רופיק את מבחני האבטחה, דיווחה לארגונים שנפגעו, והודיעה שהיא פועלת להקשיח את סביבות הניסוי. בחברה גם הדגישו שגרסאות המודלים הציבוריות כוללות שכבות הגנה הדוקות שהיו חוסמות את הפעולות האלו. -
ח חובבן מקצועי התייחס לנושא זה
-
Liquid AI - LFM 2.5 2.6B
חברת ה-AI היפנית Liquid AI משיקה את המודל החדש שלה במשקלים פתוחים: LFM 2.5 2.6B.
המודל החדש הוא שדרוג עצום של מודל הדור הקודם של החברה, LFM 2 2.6B, וממוקד בביצועי סוכן איכותיים.
המודל קטן ומהיר מספיק בשביל לפעול על CPU חלש, כמו מחשבים ביתיים פשוטים ואף פלאפונים חלשים.
LFM 2.5 2.6B אומן על 34 טריליון טוקנים, ותומך באורך הקשר של עד 128K.
המודל נועד לשמש כמודל צ'אט, או כמודל סוכן שמנהל לולאות סוכניות וקורא לכלים.
LFM 2.5 2.6B משתווה למודלי Gemma 4 הקטנים (E2B ו-E4B) וקרוב ל-Qwen 3.5 9B.
-
חדש בגוגל סטודיו!!
הכירו את ג'מיני רובוטיקס ER 2
פרטים מורחבים בספויילרת ג'מיני רובוטיקס ER 2
מערכת Gemini Robotics ER 2 מייצגת שינוי משמעותי בהפעלת רובוטים באמצעות הבנת וידאו, תזמור משימות ושיתוף פעולה מרובי רובוטים - מה שמאפשר לרובוטים להיות מועילים יותר בעולם הפיזי.
כדי שרובוטים יוכלו לסייע לבני אדם בסביבות יומיומיות, חשיבה מרחבית מדויקת אינה מספיקה. רובוטים חייבים גם לחשוב מהר, לתזמן את החלטותיהם ולהגות את החשיבה שלהם במהירות בזמן אמת של העולם הפיזי.
זו הסיבה שאנחנו משיקים היוםג'מיני רובוטיקס ER 2, מודל "החשיבה המגולמת" המסוגל ביותר שלנו לרובוטיקה. חשבו על Gemini Robotics ER 2 כמוח ברמה גבוהה עבור רובוטים. הוא מאפשר לרובוטים לשוחח עם בני אדם, להבין את העולם הפיזי ולתכנן משימות מרובות שלבים. לאחר מכן הוא מעביר את הביצוע המוטורי לכל מודל ראייה-שפה-פעולה (VLA) ברמה נמוכה יותר. Gemini Robotics ER 2 יכול גם לקרוא באופן טבעי לכלים כמו חיפוש גוגל כדי למצוא מידע, או כל פונקציה אחרת המוגדרת על ידי המשתמש. העיצוב של Gemini Robotics ER 2 מאפשר לרובוט "לחשוב" על מה שיבוא אחר כך תוך ביצוע פעולותיו בו זמנית.
ג'מיני רובוטיקס ER 2 מייצג שדרוג משמעותי לעומתג'מיני רובוטיקס ER 1.6על ידי צפייה בעדכוני וידאו רציפים, רובוטים יכולים כעת לעקוב אחר ההתקדמות שלהם, להסתגל אם משהו משתבש, ולדעת בדיוק מתי לעבור לשלב הבא. אנו גם מציגים שיתוף פעולה בין רובוטים מרובים, המאפשר לרובוטים לעבוד יחד בחללים משותפים ולהשלים זרימות עבודה מורכבות שרובוט יחיד לא יוכל לבצע לבד.
Gemini Robotics ER 2 זמין כעת לציבור למפתחים דרךממשק ה-API של ג'מיני,סטודיו גוגל בינה מלאכותית, ובתצוגה מקדימה פרטית בפלטפורמת סוכני ארגוניים של ג'מיניכדי לעזור לך להתחיל, אנו משתפיםדוגמאותכיצד להגדיר את המודל ולגרום לו להפעיל משימות בינה מלאכותית פיזיות שימושיות יותר.
קידום יכולות סוכנות פיזית
רוב המשימות בעולם הפיזי הן מורכבות ודורשות מספר שלבים להשלמה. Gemini Robotics ER 2 הוא סוכן פיזי, המתזמר שלבים עבור הרובוט ומאפשר לו לתקן את עצמו, ולהכליל למצבים חדשים יותר. כדי לבנות מערך סוכני, מפתחים יכולים להכריז על ממשקי בקרה ברמה נמוכה - כמו מודלים של Vision-Language-Action (VLA) או ממשקי API לניווט - ככלים, ולהזרים וידאו, אודיו או טקסט רב-מודאליים ישירות לתוך המודל.
ג'מיני רובוטיקס ER 2 משפר את תהליך העבודה של תזמור כלים זה. אנו יכולים להעריך את ביצועיו עם רובוטים בסימולציה, באמצעות בקרת רובוטים בעולם האמיתי, ואפילו לשלב אותו עם אדם השולט ברובוט מרחוק.ברובוטיקה, חשיבה ברמה גבוהה תלויה במהירות הביצוע. ג'מיני רובוטיקס ER 2 משתלב ב...ממשק API של ג'מיני לייב, תוך שימוש בנקודת קצה דו-כיוונית של סטרימינג, המותאמת למשימות רגישות להשהייה. התוצאה היא תזמור זורם: Gemini Robotics ER 2 מצווה על מודלי פעולה וממשקי API של רובוטיקה להשלים משימות מרובות שלבים ללא הפסקות "עצור וחשוב" מטרידות.
כדי להמחיש זאת, בנינו הדגמה עםלְזַהוֹתמהשותפים שלנו בבוסטון דיינמיקסאנו משתמשים ב-Gemini Robotics ER 2 לתזמורממשקי API של Spot, כגון ניווט ותנועת מניפולטור, ויוצרים רובוט אינטראקטיבי שיאסוף עבורך חפצים.
לא ניתן היה להפעיל את המדיה.
הקוד זמין בגיטהאבעם דוגמאות אחרות.
פתיחת אינטליגנציה זמנית להשלמת משימות בצורה איתנה
אחד האתגרים הקשים ביותר של הרובוטיקה הוא לדעת מתי משימה הסתיימה. מכשיר Gemini Robotics ER 2 מביא שינוי משמעותי בהבנת וידאו ומעקב אחר ההתקדמות כדי לוודא שמשימות מורכבות - כמו הידוק נורה או קשירת שקית אשפה - הושלמו לפי המפרט לפני המעבר למשימה הבאה.
בעדכון זה, התקדמנו בשתי יכולות בסיסיות להבנת התקדמות משימות: סיווג התקדמות ומציאת רגעים.
סיווג התקדמות מתמשכת
סיווג התקדמות מתייחס ליכולתו של רובוט לעקוב אחר התקדמות לקראת השלמת משימה. בהערכות שלנו, אנו מקצים כל פריים בשידור וידאו לחמש רמות התקדמות (0-20%, 20-40%, 40-60%, 60-80%, 80-100%). על ידי כימות התקדמות המשימה, Gemini Robotics ER 2 מספק לרובוטים מודעות מצבית בזמן אמת, ומאפשר להם להתאים פעולות תוך כדי תנועה או לנסות שוב שלבים שנכשלו מבלי להפעיל מחדש זרימת עבודה שלמה.
מציאת מומנטים מדויקת
איתור מומנטים מודד את יכולתו של מודל לזהות את פריים הווידאו המדויק שבו מתרחש אירוע קריטי (כלומר, מתי להפסיק למזוג קפה לספל). מערכת Gemini Robotics ER 2 משיגה שיפורים משמעותיים בביצועים באיתור מומנטים, ומאפשרת לרובוטים לעבור במדויק בין משימות, לאמת הצלחה ולהציע תיקונים.
שיתוף פעולה בין רובוטים מרובים
אין רובוט יחיד שמתאים לכל משימה - רכב גלגלים מצטיין בתוך מבנים, בעוד שרובוט דמוי אדם עשוי להצטיין בשטח לא אחיד. Gemini Robotics 2 מאפשר שיתוף פעולה בין רובוטים מרובים, ומאפשר למכונות מגוונות לתקשר באמצעות הבנה סמנטית משותפת כדי להעביר ולהשלים משימות מורכבות. ראו כיצד Gemini Robotics ER 2 מאפשר...אפטרוניקשלאפולו 2ופרנקה F3 דואולשתף פעולהכָּאן.
שיפור האינטליגנציה המרחבית הכללית
מערכת Gemini Robotics ER 2 משפרת את יכולות החשיבה המרחבית הבסיסיות שלנו, כפי שנמדד על ידי שלושה מדדים:
זיהוי הצלחה/כשל: כעת פועל על הזנות וידאו גולמיות במקום תמונות מצב סטטיות כדי לזהות כשלים באמצע ביצוע כמו דליפות, החלקות או חוסר יישור.
קריאת מכשירים כללית: משתרעת מעבר לחוגות עגולות וכוסות ראייה וכוללת צגים דיגיטליים, סולמות ליניאריים, סרגלים ומדחומים נוזליים. בדקנו זאת על פני 10 סוגים שונים של מכשירים.
VQA מרחבי משופר: משפר את מענה השאלות החזותיות באמצעות ההתקדמות של ג'מיני בהבנה רב-מודאלית.
קידום בטיחות עבור בינה מגולמת
Gemini Robotics ER 2 הוא המודל הבטוח ביותר שלנו, ומשיג שיפורים משמעותיים בבדיקות בטיחות וקירבה אנושית, אשר מעריכים כיצד מודל דבק באילוצים פיזיים במהלך משימות חשיבה ומודעות מרחבית לגילוי בני אדם. מצאנו ש-Gemini Robotics ER 2 עוצר בהצלחה רובוט דמוי אדם כאשר אדם נמצא בקרבת מקום ומחדש את עבודתו באופן אוטונומי רק לאחר שהאזור פנוי. כדי לקדם את הבטיחות עבור סוכנים פיזיקליים, אנו מציגים מדד שמעריך את יכולתו של מודל בסיס לפעול כמתזמר VLA בטוח על ידי בדיקת יכולתו לאכוף אילוצי בטיחות, לנטר את הסביבה, להעריך היתכנות פיזית ולבקש הבהרות אנושיות. -
המדד החדש?

מודל הדגל של מטא, Muse Spark 1.1, פרץ לחברה אחרת במהלך בדיקות אבטחת סייבר, חדר למערכות וערך שינויים במערכות פנימיות...אז כמו שזה נראה, חברות ה-AI מתחרות על תואר המודל הכי פורק עול?
יש כבר אפילו מדד ייעודי:

כמובן, זה תעלול שיווקי וגימיק נדוש...
החברות האלו אשכרה מודות בקול שהן מבצעות פשעים נגד האנושות, ועוד מתפארות בזה, אבל מה לא עושים בשביל עוד כמה דקות חשיפה ששוות את משקלן בזהב...
שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.
נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.
בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗
הרשמה התחברות


