שיתוף | מה חדש בבינה מלאכותית - מתעדכן
-
מאחר ובכל פעם שיוצא מודל או כלי AI חדש, או עדכון כלשהו למודל קיים מייד תוך כמה שעות מישהו ידאג להעלות נושא חדש עם ציטוט ארוך מאתר טכנולוגיה מזדמן המבשר באריכות על השקת המודל ויכולותיו, חשבתי פשוט ליצור נושא מתעדכן שבו יוכלו המשתמשים להעלות פוסטים קצרים ומתומצתים אודות המודלים החדשים והעדכונים, כך שכל המידע יהיה מרוכז במקום אחד, בקצרה ללא צורך לצטט כתבות שלמות כדי להצדיק פתיחת נושא חדש, ובכך למנוע הספמה של הפורום, כשלעיתים נפתחים במקביל 3 ויותר נושאים המבשרים על השקת מודל חדש...
נא לא להגיב על פוסטים אלא להעלות אך ורק עדכוני AI על מודלים וכלים חדשים וכדומה, בניסוח אנושי ומתומצת בלבד, בלי לפתוח דיונים.
מומלץ להגדיר את הנושא "במעקב" כדי להתעדכן מייד על כל פוסט שעולה.פוסט זה נמחק! -
גוגל השיקו את Gemini 3.8 Flash!


נרשם שיפור יחסית יפה (כרגע הוא רחוק רק 7 נקודות מקלוד פייבל 5.1, ו2 בלבד מgpt sol), והוא כבר דיי מתקרב ליכולות הסוכניות של קלוד כפי שהם במדד, וכל זה - במודל פלאש מהיר בטירוף!!כמו כן, הוא מופיע כבר באנטי גרביטי, בלי צורך לעדכן [למי שזוכר, בשביל לקבל את gemini 3.7 היה צריך לעדכן]

בנוגע למהירות - גם כאן גוגל רשמו עלייה נוספת במהירות, והמודל משיג 304.6 טוקנים לשנייה. (3.7 זה היה 279.4)
לשם ההשוואה קלוד פייבל 5.1 כותב 66.4 טוקנים לשנייה.
פשוט מדהים - מודל שנמצא ממש בפסגה, וכותב במהירות פשוט פסיכית.
-
גוגל נכנסת חזק לעולם העיצוב עם Google Pics
Google השיקה את Google Pics, כלי חדש ליצירה ועריכה של תמונות באמצעות AI, שמשתלב ישירות בתוך Google Workspace.
הכלי מבוסס על Nano Banana, ומכוון לא רק ליצירת תמונות אלא גם לעריכה גרפית שיכולה להתחרות בכלים כמו Canva ואפילו בחלק מהשימושים של Photoshop.
מה אפשר לעשות עם Google Pics?
- ליצור תמונות וגרפיקות מאפס באמצעות פרומפט.
- לבודד אובייקטים מתוך תמונה ולערוך רק אותם.
- להסיר או לשנות אובייקטים.
- לערוך או לתרגם טקסט שכבר מופיע בתוך תמונה.
- לקבל כמה גרסאות שונות מאותו פרומפט.
- לשנות גדלים ויחסי תצוגה.
- להגדיל תמונות לרזולוציית 2K או 4K.
- לעבוד על אותו עיצוב יחד עם משתמשים נוספים.
לא רק כלי עצמאי
החלק המעניין הוא ש־Google Pics לא נשאר אפליקציה נפרדת.
הוא משתלב ישירות בתוך Google Workspace, ומתחיל ב־:
- Google Docs
- Google Slides
ובהמשך צפוי להשתלב גם ב־Google Drive.
כך אפשר ליצור ולערוך תמונות ישירות בזמן העבודה על מסמך או מצגת, בלי לעבור לכלי חיצוני.
ויש גם תמיכה בעברית
Google Pics תומך גם בהוראות בעברית, כך שאפשר לכתוב פרומפטים ליצירה ולעריכה ישירות בעברית.
הכלי זמין גם למשתמשים בישראל, אך ההפצה מתבצעת בהדרגה ולכן ייתכן שהוא עדיין לא מופיע אצל כולם.
זמינות
ההשקה מתחילה עבור:
- מנויי Google AI Pro
- מנויי Google AI Ultra
- רוב לקוחות Google Workspace העסקיים
מידע נוסף
https://blog.google/products-and-platforms/products/workspace/google-pics/
-
מאחר ובכל פעם שיוצא מודל או כלי AI חדש, או עדכון כלשהו למודל קיים מייד תוך כמה שעות מישהו ידאג להעלות נושא חדש עם ציטוט ארוך מאתר טכנולוגיה מזדמן המבשר באריכות על השקת המודל ויכולותיו, חשבתי פשוט ליצור נושא מתעדכן שבו יוכלו המשתמשים להעלות פוסטים קצרים ומתומצתים אודות המודלים החדשים והעדכונים, כך שכל המידע יהיה מרוכז במקום אחד, בקצרה ללא צורך לצטט כתבות שלמות כדי להצדיק פתיחת נושא חדש, ובכך למנוע הספמה של הפורום, כשלעיתים נפתחים במקביל 3 ויותר נושאים המבשרים על השקת מודל חדש...
נא לא להגיב על פוסטים אלא להעלות אך ורק עדכוני AI על מודלים וכלים חדשים וכדומה, בניסוח אנושי ומתומצת בלבד, בלי לפתוח דיונים.
מומלץ להגדיר את הנושא "במעקב" כדי להתעדכן מייד על כל פוסט שעולה.פוסט זה נמחק! -
-
פוסט זה נמחק!
-
Meta - Muse Spark 1.3
מטא שחררה את המודל החדש Muse Spark 1.3 ל-Muse Code ול-API.
המודל החדש נועד בעיקר לפיתוח סוכנים בפועל ולזרימות עבודה ממושכות שמשלבות מספר סוכנים במקביל.
לראשונה מזה כמה שנים, מטא משחררת מודל ברמת מודלי הגבול, כך שבהחלט ניתן לומר שהקאמבק של מטא הושלם.
כרגע, עוצמת החשיבה Max עדיין לא זמינה לציבור.עיקרי העדכון:
- התאמה למערכות מרובות סוכנים: המודל שומר טוב יותר על ההקשר ועל תוצאות משלבים קודמים, מתמודד עם קלט לא מסודר או סותר, ויודע לעצור ולבקש הבהרות כשחסר מידע.
- יכולות קידוד: מעקב מדויק יותר אחרי הוראות ומזעור סבבי תיקון מיותרים. מתאים גם לכתיבת קוד כסוכן עצמאי וגם כעוזר פיתוח בצ'אט.
מדדים:
- אינטליגנציה:
המודל החדש עוקף את רוב מודלי הגבול כולל GPT 5.6!

- יכולות סוכן:

תמחור למיליון טוקנים:
- מסלול רגיל: $1.25 לקלט ו-$4.25 לפלט.
- מסלול Contributor ("תורם"): $0.10 לקלט ו-$0.20 לפלט בתמורה לשימוש בנתונים לשיפור מודלים.
המודל ישוחרר בקרוב בגרסת משקולות פתוחות:

קישור לבלוג ההשקה:
https://research.meta.ai/blog/introducing-muse-spark-1-3 -
IFM · K2 Horizon 0.9B/3.7B/7B/32B/36B-A4B/375B-A23B
חברת IFM (LLM360 לשעבר) משחררת את משפחת המודלים החדשה: K2 Horizon הכוללת מספר רב של גדלים עבור חומרות שונות: 0.9B, 3.7B, 7B, 32B, 36B-A4B ומודל הדגל של המשפחה - 375B-A23B.
המודלים החדשים, ששוחררו בקוד פתוח מלא (משקולות המודל, נקודות ביקורת, נתוני האימון המלאים, קוד האימון וכו') עוקפים במרבית המדדים את רוב המתחרים בטווח הגודל שלהם בפער עצום, ותופסים את ההובלה כמודלי הקוד הפתוח החזקים ביותר כיום, אבל גם בקרב מודלי המשקולות הפתוחות הם מובילים בראש המדדים, בפרט הגדלים הקטנים - 0.9B, 3.7B ו-7B שקובעים סטנדרט חדש ומשתווים לביצועי מודלים בגודל בינוני.
מדד Artificial Analysis למודל הדגל:
כמובן יש להתייחס למיקום המודל בהתאם לגודלו - לשם השוואה, Qwen3.5 397B-A17B מקבל 34 באותו מדד.

המדדים כפי שפורסמו ע"י החברה:
- K2 Horizon 375B-A23B:

- K2 Horizon 36B-A4B:

- K2 Horizon 32B:
(גרסה זו חלשה יחסית, ולטענת החברה היא באמצע אימון. המודל הסופי ישוחרר בהמשך.)

- K2 Horizon 7B:

- K2 Horizon 3.7B:

- K2 Horizon 0.9B:

כרגע המודלים מחכים בתור להוספת תמיכה ב-llama.cpp ונגזרותיה, ובינתיים יש להשתמש ב-Fork המותאם של IFM.
קישורים:
- בלוג ההשקה: https://ifm.ai/blog/k2
- https://huggingface.co/IFM/K2-Horizon-375B-A23B
- https://huggingface.co/IFM/K2-Horizon-MoVA-36B-A4B-GGUF
- https://huggingface.co/IFM/K2-Horizon-32B-GGUF
- https://huggingface.co/IFM/K2-Horizon-7B-GGUF
- https://huggingface.co/IFM/K2-Horizon-3.7B-GGUF
- https://huggingface.co/IFM/K2-Horizon-0.9B-GGUF
- K2 Horizon 375B-A23B:
-
IFM · K2 Horizon 0.9B/3.7B/7B/32B/36B-A4B/375B-A23B
חברת IFM (LLM360 לשעבר) משחררת את משפחת המודלים החדשה: K2 Horizon הכוללת מספר רב של גדלים עבור חומרות שונות: 0.9B, 3.7B, 7B, 32B, 36B-A4B ומודל הדגל של המשפחה - 375B-A23B.
המודלים החדשים, ששוחררו בקוד פתוח מלא (משקולות המודל, נקודות ביקורת, נתוני האימון המלאים, קוד האימון וכו') עוקפים במרבית המדדים את רוב המתחרים בטווח הגודל שלהם בפער עצום, ותופסים את ההובלה כמודלי הקוד הפתוח החזקים ביותר כיום, אבל גם בקרב מודלי המשקולות הפתוחות הם מובילים בראש המדדים, בפרט הגדלים הקטנים - 0.9B, 3.7B ו-7B שקובעים סטנדרט חדש ומשתווים לביצועי מודלים בגודל בינוני.
מדד Artificial Analysis למודל הדגל:
כמובן יש להתייחס למיקום המודל בהתאם לגודלו - לשם השוואה, Qwen3.5 397B-A17B מקבל 34 באותו מדד.

המדדים כפי שפורסמו ע"י החברה:
- K2 Horizon 375B-A23B:

- K2 Horizon 36B-A4B:

- K2 Horizon 32B:
(גרסה זו חלשה יחסית, ולטענת החברה היא באמצע אימון. המודל הסופי ישוחרר בהמשך.)

- K2 Horizon 7B:

- K2 Horizon 3.7B:

- K2 Horizon 0.9B:

כרגע המודלים מחכים בתור להוספת תמיכה ב-llama.cpp ונגזרותיה, ובינתיים יש להשתמש ב-Fork המותאם של IFM.
קישורים:
- בלוג ההשקה: https://ifm.ai/blog/k2
- https://huggingface.co/IFM/K2-Horizon-375B-A23B
- https://huggingface.co/IFM/K2-Horizon-MoVA-36B-A4B-GGUF
- https://huggingface.co/IFM/K2-Horizon-32B-GGUF
- https://huggingface.co/IFM/K2-Horizon-7B-GGUF
- https://huggingface.co/IFM/K2-Horizon-3.7B-GGUF
- https://huggingface.co/IFM/K2-Horizon-0.9B-GGUF
- K2 Horizon 375B-A23B:
-
פוסט זה נמחק!
-
זה מה שהם אומרים על המודל gpt 6


-
זה מה שהם אומרים על המודל gpt 6


-
ראיתי שכתבו כבר...
מנסה להביא את הכל בצורה מסודרת...רשמי: OpenAI משיקה את GPT-6 Astra – מודל הדגל החדש שלה
OpenAI הכריזה רשמית על GPT-6 Astra, המודל החדש והחזק ביותר שלה, עם דגש ברור על מעבר מצ'אט רגיל ל־סוכן AI שמסוגל לעבוד באופן עצמאי מול המחשב.
Astra מיועד לבצע רצפים ארוכים של פעולות: להשתמש בדפדפן ובמערכת ההפעלה, למלא טפסים, לעבוד עם מערכות CRM, לנהל יומן, לבצע מחקר ברשת, לכתוב מסמכים, לבנות אתרים, לנתח נתונים ואפילו לבצע בדיקות QA לממשקים.
עבודה עצמאית עם המחשב
אחד השיפורים המרכזיים ב־Astra הוא היכולת לבצע משימות מחשב מורכבות מקצה לקצה.
ב־OSWorld, לפי OpenAI, המודל משלים משימות בכ־47% פחות זמן לעומת GPT-5.6 Sol.
השיפור מגיע גם לעבודה מקצועית: Astra נבנה לעבוד טוב יותר עם מסמכים, מצגות וגיליונות, לשמור על תבניות קיימות ולהבין את הסגנון וההקשר של הארגון שבו הוא עובד.
קוד וסוכני AI
OpenAI מגדירה את Astra כמודל התוכנה הטוב ביותר שלה עד היום.
ב־Codex הוא מקבל גם יכולת חדשה לשמור ולחפש הקשר מתוך סשנים ארוכים, במקום לדחוס בכל פעם את כל היסטוריית העבודה לסיכום אחד.
המטרה היא לאפשר לסוכנים לעבוד לאורך זמן על פרויקטים מורכבים, תוך שמירה טובה יותר על ההקשר שנצבר במהלך העבודה.
תוצאות הבנצ'מרקים
לפי הנתונים שפרסמה OpenAI, Astra מציג תוצאות חריגות במספר מבחנים:
מבחן תוצאה FrontierMath Tier 4 97.6% ARC-AGI-3 99.9% ExploitBench 100% חשוב להשוואה:
חלק מהתוצאות פורסמו במסגרת מערכת הסוכנים הפנימית של OpenAI, ולכן לא בכל המקרים ניתן להשוות אותן ישירות לתוצאות של מודלים אחרים.יכולות סייבר – וגם מגבלות חדשות
ב־ExploitBench הגיע Astra לציון של 100%.
לפי OpenAI, במהלך הבדיקות המודל אף הצליח למצוא שתי חולשות Zero-Day שלא היו מוכרות קודם.
בעקבות רמת היכולות הזו, OpenAI מגבילה בשלב הראשון חלק מיכולות הסייבר המתקדמות של Astra.
שיפור גם בציות להרשאות
OpenAI טוענת שזהו גם המודל המיושר ביותר שלה עד היום.
באחת הבדיקות נבחן האם המודל יחרוג מההרשאות שניתנו לו בניסיון להשלים משימה שאינה אפשרית במסגרת ההרשאות הקיימות.
- GPT-5.6 Sol חרג מההרשאות ב־48% מהמקרים.
- GPT-6 Astra עשה זאת ב־0% מהמקרים.
זהו נתון משמעותי במיוחד עבור סוכני AI שמקבלים גישה למחשב, למידע ארגוני ולמערכות חיצוניות.
זמינות
ההשקה מתחילה היום עבור קבוצה מוגבלת של ארגונים במסגרת Daybreak Access.
במהלך הימים הקרובים Astra צפוי להגיע גם ל־:
- ChatGPT Plus
- ChatGPT Pro
- ChatGPT Business
- ChatGPT Enterprise
- ה־API של OpenAI
- Amazon Bedrock
משתמשי Pro, Business ו־Enterprise צפויים לקבל גם גישה ל־GPT-6 Astra Pro.
מחיר ב־API
המחיר שפורסם עבור Astra הוא:
- $10 למיליון טוקנים בקלט
- $50 למיליון טוקנים בפלט
כלומר, מדובר במודל יקר משמעותית מ־GPT-5.6 Sol – בהתאם למיקוד שלו במשימות מורכבות, עבודה ממושכת וסוכנים עצמאיים.
בשורה התחתונה
GPT-6 Astra הוא לא רק שדרוג נוסף ביכולות השיחה וההסקה. הדגש המרכזי כאן הוא על AI שמסוגל לבצע עבודה בפועל – להשתמש במחשב, להפעיל כלים, לעבוד לאורך זמן ולבצע תהליכים מורכבים עם פחות התערבות אנושית.
המספרים מרשימים מאוד, אבל מוקדם עדיין להכריז על "AGI" רק על סמך בנצ'מרקים. המבחן המעניין באמת יהיה לראות כיצד Astra מתפקד במשימות אמיתיות לאחר שהגישה אליו תתרחב.
ההכרזה הרשמית
https://openai.com/index/gpt-6-astra/
קצת תמונות:




שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.
נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.
בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗
הרשמה התחברות

