שיתוף | מה חדש בבינה מלאכותית - מתעדכן
-
פוסט זה נמחק!
-
Meta - Muse Spark 1.3
מטא שחררה את המודל החדש Muse Spark 1.3 ל-Muse Code ול-API.
המודל החדש נועד בעיקר לפיתוח סוכנים בפועל ולזרימות עבודה ממושכות שמשלבות מספר סוכנים במקביל.
לראשונה מזה כמה שנים, מטא משחררת מודל ברמת מודלי הגבול, כך שבהחלט ניתן לומר שהקאמבק של מטא הושלם.
כרגע, עוצמת החשיבה Max עדיין לא זמינה לציבור.עיקרי העדכון:
- התאמה למערכות מרובות סוכנים: המודל שומר טוב יותר על ההקשר ועל תוצאות משלבים קודמים, מתמודד עם קלט לא מסודר או סותר, ויודע לעצור ולבקש הבהרות כשחסר מידע.
- יכולות קידוד: מעקב מדויק יותר אחרי הוראות ומזעור סבבי תיקון מיותרים. מתאים גם לכתיבת קוד כסוכן עצמאי וגם כעוזר פיתוח בצ'אט.
מדדים:
- אינטליגנציה:
המודל החדש עוקף את רוב מודלי הגבול כולל GPT 5.6!

- יכולות סוכן:

תמחור למיליון טוקנים:
- מסלול רגיל: $1.25 לקלט ו-$4.25 לפלט.
- מסלול Contributor ("תורם"): $0.10 לקלט ו-$0.20 לפלט בתמורה לשימוש בנתונים לשיפור מודלים.
המודל ישוחרר בקרוב בגרסת משקולות פתוחות:

קישור לבלוג ההשקה:
https://research.meta.ai/blog/introducing-muse-spark-1-3 -
IFM · K2 Horizon 0.9B/3.7B/7B/32B/36B-A4B/375B-A23B
חברת IFM (LLM360 לשעבר) משחררת את משפחת המודלים החדשה: K2 Horizon הכוללת מספר רב של גדלים עבור חומרות שונות: 0.9B, 3.7B, 7B, 32B, 36B-A4B ומודל הדגל של המשפחה - 375B-A23B.
המודלים החדשים, ששוחררו בקוד פתוח מלא (משקולות המודל, נקודות ביקורת, נתוני האימון המלאים, קוד האימון וכו') עוקפים במרבית המדדים את רוב המתחרים בטווח הגודל שלהם בפער עצום, ותופסים את ההובלה כמודלי הקוד הפתוח החזקים ביותר כיום, אבל גם בקרב מודלי המשקולות הפתוחות הם מובילים בראש המדדים, בפרט הגדלים הקטנים - 0.9B, 3.7B ו-7B שקובעים סטנדרט חדש ומשתווים לביצועי מודלים בגודל בינוני.
מדד Artificial Analysis למודל הדגל:
כמובן יש להתייחס למיקום המודל בהתאם לגודלו - לשם השוואה, Qwen3.5 397B-A17B מקבל 34 באותו מדד.

המדדים כפי שפורסמו ע"י החברה:
- K2 Horizon 375B-A23B:

- K2 Horizon 36B-A4B:

- K2 Horizon 32B:
(גרסה זו חלשה יחסית, ולטענת החברה היא באמצע אימון. המודל הסופי ישוחרר בהמשך.)

- K2 Horizon 7B:

- K2 Horizon 3.7B:

- K2 Horizon 0.9B:

כרגע המודלים מחכים בתור להוספת תמיכה ב-llama.cpp ונגזרותיה, ובינתיים יש להשתמש ב-Fork המותאם של IFM.
קישורים:
- בלוג ההשקה: https://ifm.ai/blog/k2
- https://huggingface.co/IFM/K2-Horizon-375B-A23B
- https://huggingface.co/IFM/K2-Horizon-MoVA-36B-A4B-GGUF
- https://huggingface.co/IFM/K2-Horizon-32B-GGUF
- https://huggingface.co/IFM/K2-Horizon-7B-GGUF
- https://huggingface.co/IFM/K2-Horizon-3.7B-GGUF
- https://huggingface.co/IFM/K2-Horizon-0.9B-GGUF
- K2 Horizon 375B-A23B:
-
IFM · K2 Horizon 0.9B/3.7B/7B/32B/36B-A4B/375B-A23B
חברת IFM (LLM360 לשעבר) משחררת את משפחת המודלים החדשה: K2 Horizon הכוללת מספר רב של גדלים עבור חומרות שונות: 0.9B, 3.7B, 7B, 32B, 36B-A4B ומודל הדגל של המשפחה - 375B-A23B.
המודלים החדשים, ששוחררו בקוד פתוח מלא (משקולות המודל, נקודות ביקורת, נתוני האימון המלאים, קוד האימון וכו') עוקפים במרבית המדדים את רוב המתחרים בטווח הגודל שלהם בפער עצום, ותופסים את ההובלה כמודלי הקוד הפתוח החזקים ביותר כיום, אבל גם בקרב מודלי המשקולות הפתוחות הם מובילים בראש המדדים, בפרט הגדלים הקטנים - 0.9B, 3.7B ו-7B שקובעים סטנדרט חדש ומשתווים לביצועי מודלים בגודל בינוני.
מדד Artificial Analysis למודל הדגל:
כמובן יש להתייחס למיקום המודל בהתאם לגודלו - לשם השוואה, Qwen3.5 397B-A17B מקבל 34 באותו מדד.

המדדים כפי שפורסמו ע"י החברה:
- K2 Horizon 375B-A23B:

- K2 Horizon 36B-A4B:

- K2 Horizon 32B:
(גרסה זו חלשה יחסית, ולטענת החברה היא באמצע אימון. המודל הסופי ישוחרר בהמשך.)

- K2 Horizon 7B:

- K2 Horizon 3.7B:

- K2 Horizon 0.9B:

כרגע המודלים מחכים בתור להוספת תמיכה ב-llama.cpp ונגזרותיה, ובינתיים יש להשתמש ב-Fork המותאם של IFM.
קישורים:
- בלוג ההשקה: https://ifm.ai/blog/k2
- https://huggingface.co/IFM/K2-Horizon-375B-A23B
- https://huggingface.co/IFM/K2-Horizon-MoVA-36B-A4B-GGUF
- https://huggingface.co/IFM/K2-Horizon-32B-GGUF
- https://huggingface.co/IFM/K2-Horizon-7B-GGUF
- https://huggingface.co/IFM/K2-Horizon-3.7B-GGUF
- https://huggingface.co/IFM/K2-Horizon-0.9B-GGUF
- K2 Horizon 375B-A23B:
-
פוסט זה נמחק!
-
זה מה שהם אומרים על המודל gpt 6


-
זה מה שהם אומרים על המודל gpt 6


-
ראיתי שכתבו כבר...
מנסה להביא את הכל בצורה מסודרת...רשמי: OpenAI משיקה את GPT-6 Astra – מודל הדגל החדש שלה
OpenAI הכריזה רשמית על GPT-6 Astra, המודל החדש והחזק ביותר שלה, עם דגש ברור על מעבר מצ'אט רגיל ל־סוכן AI שמסוגל לעבוד באופן עצמאי מול המחשב.
Astra מיועד לבצע רצפים ארוכים של פעולות: להשתמש בדפדפן ובמערכת ההפעלה, למלא טפסים, לעבוד עם מערכות CRM, לנהל יומן, לבצע מחקר ברשת, לכתוב מסמכים, לבנות אתרים, לנתח נתונים ואפילו לבצע בדיקות QA לממשקים.
עבודה עצמאית עם המחשב
אחד השיפורים המרכזיים ב־Astra הוא היכולת לבצע משימות מחשב מורכבות מקצה לקצה.
ב־OSWorld, לפי OpenAI, המודל משלים משימות בכ־47% פחות זמן לעומת GPT-5.6 Sol.
השיפור מגיע גם לעבודה מקצועית: Astra נבנה לעבוד טוב יותר עם מסמכים, מצגות וגיליונות, לשמור על תבניות קיימות ולהבין את הסגנון וההקשר של הארגון שבו הוא עובד.
קוד וסוכני AI
OpenAI מגדירה את Astra כמודל התוכנה הטוב ביותר שלה עד היום.
ב־Codex הוא מקבל גם יכולת חדשה לשמור ולחפש הקשר מתוך סשנים ארוכים, במקום לדחוס בכל פעם את כל היסטוריית העבודה לסיכום אחד.
המטרה היא לאפשר לסוכנים לעבוד לאורך זמן על פרויקטים מורכבים, תוך שמירה טובה יותר על ההקשר שנצבר במהלך העבודה.
תוצאות הבנצ'מרקים
לפי הנתונים שפרסמה OpenAI, Astra מציג תוצאות חריגות במספר מבחנים:
מבחן תוצאה FrontierMath Tier 4 97.6% ARC-AGI-3 99.9% ExploitBench 100% חשוב להשוואה:
חלק מהתוצאות פורסמו במסגרת מערכת הסוכנים הפנימית של OpenAI, ולכן לא בכל המקרים ניתן להשוות אותן ישירות לתוצאות של מודלים אחרים.יכולות סייבר – וגם מגבלות חדשות
ב־ExploitBench הגיע Astra לציון של 100%.
לפי OpenAI, במהלך הבדיקות המודל אף הצליח למצוא שתי חולשות Zero-Day שלא היו מוכרות קודם.
בעקבות רמת היכולות הזו, OpenAI מגבילה בשלב הראשון חלק מיכולות הסייבר המתקדמות של Astra.
שיפור גם בציות להרשאות
OpenAI טוענת שזהו גם המודל המיושר ביותר שלה עד היום.
באחת הבדיקות נבחן האם המודל יחרוג מההרשאות שניתנו לו בניסיון להשלים משימה שאינה אפשרית במסגרת ההרשאות הקיימות.
- GPT-5.6 Sol חרג מההרשאות ב־48% מהמקרים.
- GPT-6 Astra עשה זאת ב־0% מהמקרים.
זהו נתון משמעותי במיוחד עבור סוכני AI שמקבלים גישה למחשב, למידע ארגוני ולמערכות חיצוניות.
זמינות
ההשקה מתחילה היום עבור קבוצה מוגבלת של ארגונים במסגרת Daybreak Access.
במהלך הימים הקרובים Astra צפוי להגיע גם ל־:
- ChatGPT Plus
- ChatGPT Pro
- ChatGPT Business
- ChatGPT Enterprise
- ה־API של OpenAI
- Amazon Bedrock
משתמשי Pro, Business ו־Enterprise צפויים לקבל גם גישה ל־GPT-6 Astra Pro.
מחיר ב־API
המחיר שפורסם עבור Astra הוא:
- $10 למיליון טוקנים בקלט
- $50 למיליון טוקנים בפלט
כלומר, מדובר במודל יקר משמעותית מ־GPT-5.6 Sol – בהתאם למיקוד שלו במשימות מורכבות, עבודה ממושכת וסוכנים עצמאיים.
בשורה התחתונה
GPT-6 Astra הוא לא רק שדרוג נוסף ביכולות השיחה וההסקה. הדגש המרכזי כאן הוא על AI שמסוגל לבצע עבודה בפועל – להשתמש במחשב, להפעיל כלים, לעבוד לאורך זמן ולבצע תהליכים מורכבים עם פחות התערבות אנושית.
המספרים מרשימים מאוד, אבל מוקדם עדיין להכריז על "AGI" רק על סמך בנצ'מרקים. המבחן המעניין באמת יהיה לראות כיצד Astra מתפקד במשימות אמיתיות לאחר שהגישה אליו תתרחב.
ההכרזה הרשמית
https://openai.com/index/gpt-6-astra/
קצת תמונות:




שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.
נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.
בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗
הרשמה התחברות

