שיתוף | מה חדש בבינה מלאכותית - מתעדכן
-
DeepSeek · DeepSeek V4 Flash Vision Exp
DeepSeek משיקה את המודל החדש: DeepSeek V4 Flash Vision Exp, גרסת מודל ראיה למודל החזק שלה - DeepSeek V4 Flash.
בנוסף ליכולות הראיה, המודל משתפר מאוד במרבית המדדים לעומת קודמו:

בין השיפורים:
• קלט טקסט ותמונה מקוריים מאפשרים לסוכנים לבדוק מצבי ממשק משתמש, צילומי מסך, תרשימים ופריטים חזותיים אחרים תוך כדי המשך השימוש בכלים.• DeepSeek מדווחת על שיפור משמעותי בהשוואה ל-V4 Flash במבחני ביצועים של סוכנים חזותיים, עם ביצועים קרובים ל-Opus 4.8; זוהי השוואה המנוהלת על ידי ספק.
• השלמות צ'אט, הודעות ותגובות נתמכות, כאשר תמונות מסופקות דרך base64, כתובות URL חיצוניות או מזהה קובץ של Files API.
• ממשק ה-API של קבצים מאפשר ליישומים להעלות תמונה פעם אחת ולעשות בה שימוש חוזר בבקשות שונות; תמונות מזהה קובץ יכולות להיות בגודל של עד 64 מגה-בייט לעומת 32 מגה-בייט עבור תמונות מוטבעות או תמונות URL.
DeepSeek מתייגת גרסה זו כניסיונית ולא כזמינה באופן כללי.
-
השבוע גוגל פרסמה שג'מה חוגגת מיליארד הורדות
-
Qwen - Qwen 3.8 Flash Next
Qwen מכריזה על השקת המודל החדש Qwen 3.8 Flash Next, מודל MoE המבוסס על ארכיטקטורת Qwen 4 העתידית, על מנת לאפשר לציבור להתאים לארכיטקטורה החדשה בהשקה המלאה של משפחת Qwen 4.
הארכיטקטורה החדשנית המשמשת במודל הזה, מתבססת בעצם על הטכנולוגיה שפותחה ע"י גוגל במודלי Gemma Edge (המודלים הקטנים של Gemma), E2B ו-E4B, שבה רק חלק מהפרמטרים הינם פרמטרים "אפקטיביים", כלומר רגילים בעלי יכולות היגיון והסקה, בעוד שאר הפרמטרים הם בעצם טבלת n_gram של פרמטרי הטמעה - כמו ספריית ידע צדדית שהמודל יכול לשלוף ממנה מידע, והיא אינה דורשת כוח עיבוד מיוחד ואפשר לטעון אותה אפילו לדיסק.
אז המודל החדש הוא 125B A6B - כלומר בעל 125B פרמטרים אפקטיביים - רגילים, כשמתוכם 6B פעילים עבור כל טוקן, בנוסף ל-51B פרמטרי הטמעה נפרדים, הניתנים לטעינה לדיסק.
הארכיטקטורה הזאת מאפשרת למודל להיות מהיר כמעט כמו מודל קטן של 6B בלבד, עם יכולות של 125B, וידע של עוד 51B בנוסף!
Qwen לא סיפקו מידע נוסף בנוגע למודלים הבאים של סדרת Qwen 4, והאם כולם יהיו בארכיטקטורה החדשה או רק חלקם.מדדים - בהמשך השרשור.
קישור:
https://huggingface.co/models/Qwen/Qwen3.8-Flash-Next -
מגבלת ה5 שעות בקודקס חזרה.

-
מגבלת ה5 שעות בקודקס חזרה.

-
IBM - Granite 4.2 3B/8B/30B
IBM משחררת את משפחת המודלים החדשה - Granite 4.2, עם 3 גדלי מודל - 3B, 8B ו-30B.
המודלים החדשים פחות חזקים בקידוד ממודלי החזית הבינוניים כמו Qwen 3.8 27B, אבל מתייחדים במערכי נתונים פתוחים, בהתחייבות של IBM שהמודלים לא עלולים לפלוט טקסטים הפוגעים בזכויות יוצרים (חיוני לעסקים וארגונים), וכן ביכולות RAG גבוהות וידע כללי.קישורים:
https://huggingface.co/ibm-granite/granite-4.2-3b-GGUF
https://huggingface.co/ibm-granite/granite-4.2-8b-GGUF
https://huggingface.co/ibm-granite/granite-4.2-30b-GGUF -
-
סוף סוף, המודל האנונימי שתפס כותרות בכל העולם OX ALPHA והיצרן שלו היה חסוי, התברר כ GLM 5.3 פלאש! שימו לב לכותרת בדף המודל באופן ראוטר
והמדדים שלו לא יאומנו! והמחיר עוד יותר לא יאומן כי יסופר
לא הצלחתי לצלם מסך אז העליתי קישורים
@א.מ.ד. לא האמנתי שאקדים אותך
אני בדרך כלל סומך עליך, וכמוני עוד רבים כנראה -
גוגל משיקה את Gemini 3.5 Transcribe, מודל המרת דיבור לטקסט
גוגל השיקה ביום רביעי את Gemini 3.5 Transcribe, מודל המרת דיבור לטקסט המיועד לתמלול בזמן אמת, עם דיוק משופר וזמן תגובה מופחת בהשוואה לגרסתו הקודמת.
המודל ממיר שמע לטקסט מעוצב ומתמודד עם רעשי רקע, מינוח טכני ותיקונים של הדובר. Gemini 3.5 Transcribe משיג שיעור שגיאות מילים של 4.0% בתמלול סטרימינג ו-2.6% ביישומים שאינם סטרימינג, על פי מדידות של Artificial Analysis. הטכנולוגיה משפרת את זמן ההגעה לתמלול הסופי ב-70% לעומת מודל Chirp 3 הקודם.
גוגל מעמידה את המודל לשימוש דרך שני ממשקי תכנות יישומים. אפשרות הסטרימינג בזמן אמת מספקת זמן תגובה של פחות משנייה דרך Live API תוך שימוש ב-gemini-3.5-transcribe-live. אפשרות עיבוד השמע המוקלט מראש מתמללת פגישות ויומני שיחות עם ייחוס לדוברים דרך Interactions API תוך שימוש ב-gemini-3.5-transcribe.
המודל תומך בזיהוי ותמלול אוטומטי של למעלה מ-85 שפות ומזהה עד שלושה דוברים בשמע מוקלט מראש עם חותמות זמן. בין התכונות: הסרת מילות מילוי, עיצוב טקסט אוטומטי וזיהוי אוצר מילים מותאם אישית למינוח מקצועי. במדד הייחוס FLEURS, Gemini 3.5 Transcribe משיג שיעור שגיאות מילים של 5.50% במצב סטרימינג ו-5.04% בשימושים שאינם סטרימינג.
גוגל משלבת את הטכנולוגיה במוצרים שונים, ובהם אפליקציית Gemini ב-macOS, תכונת Rambler באנדרואיד דרך Gboard ו-Google AI Studio. המודל נכנס לתצוגה מקדימה ציבורית למפתחים דרך Google AI Studio ולארגונים דרך Gemini Enterprise Agent Platform. Chrome יקבל את יכולת הכתיב בעתיד.
-
גוגל מציגה את GlucoFM – מודל בסיס לנתוני ניטור סוכר רציף
Google Research הציגה את GlucoFM, מודל Foundation חדש שנבנה במיוחד לעבודה עם נתונים ממערכות ניטור סוכר רציף (CGM).
במקום להתייחס למדידות הסוכר כרצף נתונים אחד, GlucoFM מפריד אותן לשני סוגי מידע:
- State – מגמות הסוכר האיטיות והמתמשכות.
- Event – שינויים וקפיצות קצרות טווח, למשל סביב ארוחות.
ההפרדה הזו מאפשרת למודל ללמוד בצורה טובה יותר גם את המצב הבסיסי של רמות הסוכר וגם אירועים נקודתיים.
מה אפשר לעשות עם המודל?
לפי המחקר של Google, ניתן להשתמש ב־GlucoFM למגוון משימות, בהן:
- הערכת סיכון לסוכרת.
- זיהוי עמידות לאינסולין.
- חיזוי תגובת הסוכר לאחר ארוחה.
- זיהוי דפוסים ומצבים נוספים מתוך נתוני CGM.
בבדיקות שערכה Google, המודל הציג ביצועים טובים יותר ממודלים קיימים ברוב ההשוואות שנבדקו.
למה זה מעניין?
זו עוד דוגמה לאופן שבו מודלי Foundation מתרחבים מעבר לטקסט, תמונות וקוד – ומתחילים להתמחות גם בסוגי מידע רפואיים מאוד ספציפיים.
מדובר במודל מחקרי ובתוצאות מחקר, ולא בכלי שמחליף אבחון או ייעוץ רפואי.
למחקר ולפרטים נוספים
https://research.google/blog/glucofm-foundation-model-for-continuous-glucose-monitoring/

-
מדדי Qwen 3.8 Flash Next:
-
אינטליגנציה כללית:

משתווה ל-Gemini 3.7 Flash עם חשיבה חזקה, ול-GPT 5.5 עם חשיבה אקסטרה-חזקה. -
יכולות סוכן:

משתווה לקלוד אופוס 5 עם חשיבה חזקה, ועוקף את GPT 5.6 Sol עם חשיבה אקסטרה-חזקה!!!
ומה שהכי מפתיע, זה העובדה שמדובר במודל עם 125B פרמטרים בסך הכל, עם רק 6B פעילים! הארכיטקטורה החדשה של Qwen 4 מתבררת ככל הנראה כשינוי המבטיח שיאפשר הרצת מודלי-על על חומרה צרכנית עם GPU קטן...
> @אמיץ כתב בשיתוף | מה חדש בבינה מלאכותית - מתעדכן:
@א.מ.ד. לא האמנתי שאקדים אותך אני בדרך כלל סומך עליך, וכמוני עוד רבים כנראה
גם אם אני רואה מיד, לא תמיד אני ליד המחשב בשביל לפרסם...
-
-
גוגל משיקה את Gemini Omni 1.1 Flash – מודל ליצירה ולעריכת וידאו
גוגל השיקה את Gemini Omni 1.1 Flash, מודל ייעודי ליצירה ועריכה של וידאו שמתמקד במתן כלי שליטה מדויקים יותר למפתחים וליוצרים.
במקום להתמקד רק ביצירת וידאו מטקסט חופשי, המודל מציע סט כלים שנועד לפתור בעיות נפוצות כמו חוסר עקביות בין שוטים ובזבוז משאבים על טיוטות.
היכולות המרכזיות של המודל
- הגדרת פריים פתיחה וסיום: מאפשר לקבוע נקודת התחלה וסיום מדויקות לצילום, כשהמודל משלים את התנועה הרציפה ביניהן. מתאים במיוחד לתנועות מצלמה מורכבות, זום ולופים.
- הארכת סצנות: ניתוח של עד 10 שניות מצילום קודם כדי להמשיך את הסצנה ברצף, תוך שמירה על עקביות הדמויות, התאורה והקונטקסט.
- הזנת וידאו כרפרנס: שילוב של עד 3 שניות וידאו כקלט למיפוי תנועה, סגנון ושמירה על נראות הדמויות.
- תהליך עבודה חסכוני (טיוטה לשדרוג): יצירת בדיקות מהירות ברזולוציית 360p בעלות נמוכה, עם אפשרות לשדרג (Upscale) את התוצאות הנבחרות ל-720p, 1080p ועד 4K.
זמינות וגישה
- למפתחים: זמין כעת ב-Google AI Studio, ב-Flow ובפלטפורמת Gemini Enterprise Agent.
- למשתמשים: תכונת הארכת הסצנות פתוחה באפליקציית Gemini למנויי Google AI (במסלולי Plus, Pro ו-Ultra).
-
Meta - Muse Image
Meta שחררה רשמית ל-API שלה את Muse Image - מודל יצירת ועריכת תמונות מבוסס תהליכי חשיבה סוכנית, כשהבשורה הגדולה כאן היא שילוב של איכות גבוהה עם תג מחיר נגיש ביותר: 0.01$ בלבד לתמונה.
מה שהופך את המודל למעניין במיוחד מול מודלים רגילים בתחום הוא תהליך העבודה הפנימי שלו: המודל חושב ומתכנן לפני שהוא יוצר תמונה, ואפילו מסוגל לבצע קריאות חיפוש ברשת כדי לבדוק ולאמת את התוצאה לפני שהוא מחזיר את הפלט הסופי.
נקודות מרכזיות ויכולות בולטות:
- יצירה ועריכה תחת אותו מודל: אין צורך להחליף מודלים או שרשראות נפרדות כדי לערוך תמונה קיימת או ליצור מאפס. הוא מטפל ביצירה, עריכה ושילוב אלמנטים באותו API.
- עריכה סלקטיבית מרובת שלבים: אפשר לבקש שינויים נקודתיים מבלי שהמודל "יהרוס" או ישנה את שאר חלקי התמונה, והאיכות נשמרת לאורך כמה סבבי עריכה רצופים בלי דגרדציה.
- עבודה מבוססת רפרנסים: מאפשר להזין תמונות ייחוס כדי לשמור על עקביות מושלמת של דמויות, סגנון עיצובי, או סביבה לאורך סדרה שלמה של תמונות.
- איכות ורנדור טקסט: תמיכה ברזולוציה של עד 1600px, עם שליטה מדויקת בקומפוזיציה ויכולת רינדור טקסט מובנה בצורה נקייה.
- עלות ייצור: במחיר של סנט בודד לתמונה, מטא מכוונת ישירות לאוטומציות, קטלוגים מותאמים אישית והרצה בסקילים.
ניתן לראות כאן שהמודל החדש הוא הזול ביותר ביחס לאיכות הפלט:

המודל זמין כעת דרך ה-API של מטא.
קישור:
-
אנתרופיק תפסיק את המבצע הזמני על הגדלת המכסות ב50% ב14 בספטמבר ובמקום זה הכריזה על שדרוג קבוע של 25%. התוצאה בפועל: ירידה של 17% במכסה השבועית.
-
VoiceStudio שוחררה – יצירת קריינות ושכפול קול ישירות מהמחשב
כלי חדש ומעניין בתחום ה־AI לאודיו: VoiceStudio מאפשר ליצור קריינות, לשכפל קולות, לתמלל אודיו ולדבב סרטונים – והכול באופן מקומי על המחשב.
מה אפשר לעשות?
- לשכפל קול מתוך הקלטה קצרה ולהשתמש בו להקראת טקסט.
- ליצור קריינות לסרטונים, ספרי שמע ותכנים נוספים.
- לבצע דיבוב לסרטונים.
- לתמלל קובצי אודיו לטקסט.
- לבחור מתוך 16 מנועי Text-to-Speech שונים.
- להשתמש ב־11 מנועי זיהוי דיבור.
והיתרון הגדול – הכול מקומי
VoiceStudio פועלת ישירות על המחשב, ללא צורך בשירות ענן.
- אין צורך בחשבון.
- אין מנוי.
- אין תשלום לפי יצירה.
- הפרויקט זמין בחינם.
תאימות:
VoiceStudio זמינה עבור Windows, macOS ו־Linux.הורדה ומידע נוסף
-
OpenClaw 2.0: שדרוג ענק לסוכן הקוד הפתוח - עם תמיכה מקומית, ממשק חדש וזיכרון מתמשך!
אחרי כמעט 7 שבועות של שקט ומעל 16,000 Pull Requests, שוחררה רשמית גרסה 2.0 של OpenClaw (הסוכן האוטונומי שהתחיל כ-Clawdbot של פיטר סטיינברגר) –-ומדובר בעדכון הגדול ביותר מאז ההשקה.
מעבר למתיחת פנים רצינית, הפוקוס המרכזי כאן הוא הנגשה, מהירות ושיפור יכולות העבודה ברקע כסוכן עצמאי שלומד תוך כדי תנועה.
מה חדש בגרסה 2.0:
- התקנה חכמה ומהירה: אשף ההתקנה מזהה ומגדיר אוטומטית מפתחות API קיימים, מנויי Claude / ChatGPT ומודלים שמותקנים אצלכם מקומית, כדי שתוכלו להיכנס ישר לעבודה בלי להסתבך בהגדרות ידניות.
- ממשק דפדפן מחודש: אפליקציית Web חדשה שנפתחת ישירות לשיחה, כוללת חיפוש בהיסטוריית הצ'אטים, מעקב אחר התקדמות משימות, הזנה מאובטחת של פרטים רגישים (מוסווים) ואינטגרציה עמוקה יותר ל-Slack.
- מנגנון "חלומות" וזיכרון לטווח ארוך: הסוכן מסוגל לעבד מידע ברקע בזמן מנוחה, לגבש תובנות קריטיות לזיכרון ארוך-טווח, ולייצר לעצמו מיומנויות (סקילים) חדשות על בסיס דפוסי שימוש שחוזרים על עצמם.
- מולטי-טאסקינג ושליטה מלאה: מעבר חלק בין משימות שונות (למשל מעקב אחר תיבת מייל וחיפוש מידע במקביל), עבודה על Sessions משותפים, שליטה על שולחן העבודה, ואפילו הצטרפות ותמלול של שיחות זום/Teams.
- ייבוא מכלים מתחרים: אפשרות לייבא בקלות היסטוריה וזיכרונות קיימים ישירות מ-Claude Code, Codex ו-Hermes.
קישורים לכתבות בנושא:
https://www.geektime.co.il/openclaw-2-0-released/
https://www.gadgety.co.il/368309/openclaw-2-launched/
https://www.tgspot.co.il/openclaw-reached-version-2-0/ -
Anthropic משיקה את Claude Fable 5.1 – שדרוג משמעותי לסוכני AI
Anthropic השיקה את Claude Fable 5.1, שדרוג חדש למודל הדגל שלה, עם דגש חזק על סוכני AI, מחקר מדעי, כתיבת קוד ואוטומציה.
למרות שהשם נשמע כמו עדכון קטן של 0.1, לפי הנתונים שפרסמה החברה מדובר בקפיצה משמעותית – במיוחד במשימות ארוכות ומורכבות שמבוצעות על ידי סוכנים.
הביצועים
ב־Terminal-Bench-Science, המודל החדש הגיע ל־52.6% – שיפור משמעותי לעומת:
מודל תוצאה Claude Fable 5.1 52.6% Opus 5 29% Fable 5 24.7% GPT-5.6 Sol 22.4% בנוסף, Fable 5.1 הגיע ל־:
- 55.8% ב־Terminal-Bench 4.0.
- 73.4% ב־CursorBench.
- 31.4% ב־AutomationBench.
לא רק קוד
לפי Anthropic, השיפור אינו מוגבל למשימות תכנות. Fable 5.1 מציג ביצועים טובים יותר גם ב־:
- משימות ידע ומחקר.
- שימוש במחשב.
- חשיבה רב־תחומית.
- תהליכים עסקיים.
- אוטומציות ומשימות Agent ארוכות.
וגם המחיר יורד
לצד השיפור בביצועים, Anthropic טוענת שגם עלות העבודה עם המודל צפויה להיות נמוכה יותר.
- במשימות רגילות המחויבות לפי טוקנים – העלות צפויה להיות נמוכה בכ־25% לעומת Fable 5.
- במשימות סוכנים ארוכות ומורכבות – החיסכון עשוי להגיע לכ־45%.
בקיצור, Fable 5.1 אולי נשמע כמו עדכון גרסה קטן, אבל בפועל נראה שהשדרוג המרכזי נמצא בדיוק במקום שאליו התעשייה הולכת: סוכני AI שעובדים לאורך זמן ומבצעים משימות מורכבות ורב־שלביות.
https://www.anthropic.com/claude-fable-and-mythos-5-1

-
Anthropic משיקה את Claude Fable 5.1 – שדרוג משמעותי לסוכני AI
Anthropic השיקה את Claude Fable 5.1, שדרוג חדש למודל הדגל שלה, עם דגש חזק על סוכני AI, מחקר מדעי, כתיבת קוד ואוטומציה.
למרות שהשם נשמע כמו עדכון קטן של 0.1, לפי הנתונים שפרסמה החברה מדובר בקפיצה משמעותית – במיוחד במשימות ארוכות ומורכבות שמבוצעות על ידי סוכנים.
הביצועים
ב־Terminal-Bench-Science, המודל החדש הגיע ל־52.6% – שיפור משמעותי לעומת:
מודל תוצאה Claude Fable 5.1 52.6% Opus 5 29% Fable 5 24.7% GPT-5.6 Sol 22.4% בנוסף, Fable 5.1 הגיע ל־:
- 55.8% ב־Terminal-Bench 4.0.
- 73.4% ב־CursorBench.
- 31.4% ב־AutomationBench.
לא רק קוד
לפי Anthropic, השיפור אינו מוגבל למשימות תכנות. Fable 5.1 מציג ביצועים טובים יותר גם ב־:
- משימות ידע ומחקר.
- שימוש במחשב.
- חשיבה רב־תחומית.
- תהליכים עסקיים.
- אוטומציות ומשימות Agent ארוכות.
וגם המחיר יורד
לצד השיפור בביצועים, Anthropic טוענת שגם עלות העבודה עם המודל צפויה להיות נמוכה יותר.
- במשימות רגילות המחויבות לפי טוקנים – העלות צפויה להיות נמוכה בכ־25% לעומת Fable 5.
- במשימות סוכנים ארוכות ומורכבות – החיסכון עשוי להגיע לכ־45%.
בקיצור, Fable 5.1 אולי נשמע כמו עדכון גרסה קטן, אבל בפועל נראה שהשדרוג המרכזי נמצא בדיוק במקום שאליו התעשייה הולכת: סוכני AI שעובדים לאורך זמן ומבצעים משימות מורכבות ורב־שלביות.
https://www.anthropic.com/claude-fable-and-mythos-5-1

שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.
נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.
בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗
הרשמה התחברות
