שיתוף | מה חדש בבינה מלאכותית - מתעדכן
-
סוף סוף, המודל האנונימי שתפס כותרות בכל העולם OX ALPHA והיצרן שלו היה חסוי, התברר כ GLM 5.3 פלאש! שימו לב לכותרת בדף המודל באופן ראוטר
והמדדים שלו לא יאומנו! והמחיר עוד יותר לא יאומן כי יסופר
לא הצלחתי לצלם מסך אז העליתי קישורים
@א.מ.ד. לא האמנתי שאקדים אותך
אני בדרך כלל סומך עליך, וכמוני עוד רבים כנראה -
גוגל משיקה את Gemini 3.5 Transcribe, מודל המרת דיבור לטקסט
גוגל השיקה ביום רביעי את Gemini 3.5 Transcribe, מודל המרת דיבור לטקסט המיועד לתמלול בזמן אמת, עם דיוק משופר וזמן תגובה מופחת בהשוואה לגרסתו הקודמת.
המודל ממיר שמע לטקסט מעוצב ומתמודד עם רעשי רקע, מינוח טכני ותיקונים של הדובר. Gemini 3.5 Transcribe משיג שיעור שגיאות מילים של 4.0% בתמלול סטרימינג ו-2.6% ביישומים שאינם סטרימינג, על פי מדידות של Artificial Analysis. הטכנולוגיה משפרת את זמן ההגעה לתמלול הסופי ב-70% לעומת מודל Chirp 3 הקודם.
גוגל מעמידה את המודל לשימוש דרך שני ממשקי תכנות יישומים. אפשרות הסטרימינג בזמן אמת מספקת זמן תגובה של פחות משנייה דרך Live API תוך שימוש ב-gemini-3.5-transcribe-live. אפשרות עיבוד השמע המוקלט מראש מתמללת פגישות ויומני שיחות עם ייחוס לדוברים דרך Interactions API תוך שימוש ב-gemini-3.5-transcribe.
המודל תומך בזיהוי ותמלול אוטומטי של למעלה מ-85 שפות ומזהה עד שלושה דוברים בשמע מוקלט מראש עם חותמות זמן. בין התכונות: הסרת מילות מילוי, עיצוב טקסט אוטומטי וזיהוי אוצר מילים מותאם אישית למינוח מקצועי. במדד הייחוס FLEURS, Gemini 3.5 Transcribe משיג שיעור שגיאות מילים של 5.50% במצב סטרימינג ו-5.04% בשימושים שאינם סטרימינג.
גוגל משלבת את הטכנולוגיה במוצרים שונים, ובהם אפליקציית Gemini ב-macOS, תכונת Rambler באנדרואיד דרך Gboard ו-Google AI Studio. המודל נכנס לתצוגה מקדימה ציבורית למפתחים דרך Google AI Studio ולארגונים דרך Gemini Enterprise Agent Platform. Chrome יקבל את יכולת הכתיב בעתיד.
-
גוגל מציגה את GlucoFM – מודל בסיס לנתוני ניטור סוכר רציף
Google Research הציגה את GlucoFM, מודל Foundation חדש שנבנה במיוחד לעבודה עם נתונים ממערכות ניטור סוכר רציף (CGM).
במקום להתייחס למדידות הסוכר כרצף נתונים אחד, GlucoFM מפריד אותן לשני סוגי מידע:
- State – מגמות הסוכר האיטיות והמתמשכות.
- Event – שינויים וקפיצות קצרות טווח, למשל סביב ארוחות.
ההפרדה הזו מאפשרת למודל ללמוד בצורה טובה יותר גם את המצב הבסיסי של רמות הסוכר וגם אירועים נקודתיים.
מה אפשר לעשות עם המודל?
לפי המחקר של Google, ניתן להשתמש ב־GlucoFM למגוון משימות, בהן:
- הערכת סיכון לסוכרת.
- זיהוי עמידות לאינסולין.
- חיזוי תגובת הסוכר לאחר ארוחה.
- זיהוי דפוסים ומצבים נוספים מתוך נתוני CGM.
בבדיקות שערכה Google, המודל הציג ביצועים טובים יותר ממודלים קיימים ברוב ההשוואות שנבדקו.
למה זה מעניין?
זו עוד דוגמה לאופן שבו מודלי Foundation מתרחבים מעבר לטקסט, תמונות וקוד – ומתחילים להתמחות גם בסוגי מידע רפואיים מאוד ספציפיים.
מדובר במודל מחקרי ובתוצאות מחקר, ולא בכלי שמחליף אבחון או ייעוץ רפואי.
למחקר ולפרטים נוספים
https://research.google/blog/glucofm-foundation-model-for-continuous-glucose-monitoring/

-
מדדי Qwen 3.8 Flash Next:
-
אינטליגנציה כללית:

משתווה ל-Gemini 3.7 Flash עם חשיבה חזקה, ול-GPT 5.5 עם חשיבה אקסטרה-חזקה. -
יכולות סוכן:

משתווה לקלוד אופוס 5 עם חשיבה חזקה, ועוקף את GPT 5.6 Sol עם חשיבה אקסטרה-חזקה!!!
ומה שהכי מפתיע, זה העובדה שמדובר במודל עם 125B פרמטרים בסך הכל, עם רק 6B פעילים! הארכיטקטורה החדשה של Qwen 4 מתבררת ככל הנראה כשינוי המבטיח שיאפשר הרצת מודלי-על על חומרה צרכנית עם GPU קטן...
> @אמיץ כתב בשיתוף | מה חדש בבינה מלאכותית - מתעדכן:
@א.מ.ד. לא האמנתי שאקדים אותך אני בדרך כלל סומך עליך, וכמוני עוד רבים כנראה
גם אם אני רואה מיד, לא תמיד אני ליד המחשב בשביל לפרסם...
-
-
גוגל משיקה את Gemini Omni 1.1 Flash – מודל ליצירה ולעריכת וידאו
גוגל השיקה את Gemini Omni 1.1 Flash, מודל ייעודי ליצירה ועריכה של וידאו שמתמקד במתן כלי שליטה מדויקים יותר למפתחים וליוצרים.
במקום להתמקד רק ביצירת וידאו מטקסט חופשי, המודל מציע סט כלים שנועד לפתור בעיות נפוצות כמו חוסר עקביות בין שוטים ובזבוז משאבים על טיוטות.
היכולות המרכזיות של המודל
- הגדרת פריים פתיחה וסיום: מאפשר לקבוע נקודת התחלה וסיום מדויקות לצילום, כשהמודל משלים את התנועה הרציפה ביניהן. מתאים במיוחד לתנועות מצלמה מורכבות, זום ולופים.
- הארכת סצנות: ניתוח של עד 10 שניות מצילום קודם כדי להמשיך את הסצנה ברצף, תוך שמירה על עקביות הדמויות, התאורה והקונטקסט.
- הזנת וידאו כרפרנס: שילוב של עד 3 שניות וידאו כקלט למיפוי תנועה, סגנון ושמירה על נראות הדמויות.
- תהליך עבודה חסכוני (טיוטה לשדרוג): יצירת בדיקות מהירות ברזולוציית 360p בעלות נמוכה, עם אפשרות לשדרג (Upscale) את התוצאות הנבחרות ל-720p, 1080p ועד 4K.
זמינות וגישה
- למפתחים: זמין כעת ב-Google AI Studio, ב-Flow ובפלטפורמת Gemini Enterprise Agent.
- למשתמשים: תכונת הארכת הסצנות פתוחה באפליקציית Gemini למנויי Google AI (במסלולי Plus, Pro ו-Ultra).
-
Meta - Muse Image
Meta שחררה רשמית ל-API שלה את Muse Image - מודל יצירת ועריכת תמונות מבוסס תהליכי חשיבה סוכנית, כשהבשורה הגדולה כאן היא שילוב של איכות גבוהה עם תג מחיר נגיש ביותר: 0.01$ בלבד לתמונה.
מה שהופך את המודל למעניין במיוחד מול מודלים רגילים בתחום הוא תהליך העבודה הפנימי שלו: המודל חושב ומתכנן לפני שהוא יוצר תמונה, ואפילו מסוגל לבצע קריאות חיפוש ברשת כדי לבדוק ולאמת את התוצאה לפני שהוא מחזיר את הפלט הסופי.
נקודות מרכזיות ויכולות בולטות:
- יצירה ועריכה תחת אותו מודל: אין צורך להחליף מודלים או שרשראות נפרדות כדי לערוך תמונה קיימת או ליצור מאפס. הוא מטפל ביצירה, עריכה ושילוב אלמנטים באותו API.
- עריכה סלקטיבית מרובת שלבים: אפשר לבקש שינויים נקודתיים מבלי שהמודל "יהרוס" או ישנה את שאר חלקי התמונה, והאיכות נשמרת לאורך כמה סבבי עריכה רצופים בלי דגרדציה.
- עבודה מבוססת רפרנסים: מאפשר להזין תמונות ייחוס כדי לשמור על עקביות מושלמת של דמויות, סגנון עיצובי, או סביבה לאורך סדרה שלמה של תמונות.
- איכות ורנדור טקסט: תמיכה ברזולוציה של עד 1600px, עם שליטה מדויקת בקומפוזיציה ויכולת רינדור טקסט מובנה בצורה נקייה.
- עלות ייצור: במחיר של סנט בודד לתמונה, מטא מכוונת ישירות לאוטומציות, קטלוגים מותאמים אישית והרצה בסקילים.
ניתן לראות כאן שהמודל החדש הוא הזול ביותר ביחס לאיכות הפלט:

המודל זמין כעת דרך ה-API של מטא.
קישור:
-
אנתרופיק תפסיק את המבצע הזמני על הגדלת המכסות ב50% ב14 בספטמבר ובמקום זה הכריזה על שדרוג קבוע של 25%. התוצאה בפועל: ירידה של 17% במכסה השבועית.
-
VoiceStudio שוחררה – יצירת קריינות ושכפול קול ישירות מהמחשב
כלי חדש ומעניין בתחום ה־AI לאודיו: VoiceStudio מאפשר ליצור קריינות, לשכפל קולות, לתמלל אודיו ולדבב סרטונים – והכול באופן מקומי על המחשב.
מה אפשר לעשות?
- לשכפל קול מתוך הקלטה קצרה ולהשתמש בו להקראת טקסט.
- ליצור קריינות לסרטונים, ספרי שמע ותכנים נוספים.
- לבצע דיבוב לסרטונים.
- לתמלל קובצי אודיו לטקסט.
- לבחור מתוך 16 מנועי Text-to-Speech שונים.
- להשתמש ב־11 מנועי זיהוי דיבור.
והיתרון הגדול – הכול מקומי
VoiceStudio פועלת ישירות על המחשב, ללא צורך בשירות ענן.
- אין צורך בחשבון.
- אין מנוי.
- אין תשלום לפי יצירה.
- הפרויקט זמין בחינם.
תאימות:
VoiceStudio זמינה עבור Windows, macOS ו־Linux.הורדה ומידע נוסף
-
OpenClaw 2.0: שדרוג ענק לסוכן הקוד הפתוח - עם תמיכה מקומית, ממשק חדש וזיכרון מתמשך!
אחרי כמעט 7 שבועות של שקט ומעל 16,000 Pull Requests, שוחררה רשמית גרסה 2.0 של OpenClaw (הסוכן האוטונומי שהתחיל כ-Clawdbot של פיטר סטיינברגר) –-ומדובר בעדכון הגדול ביותר מאז ההשקה.
מעבר למתיחת פנים רצינית, הפוקוס המרכזי כאן הוא הנגשה, מהירות ושיפור יכולות העבודה ברקע כסוכן עצמאי שלומד תוך כדי תנועה.
מה חדש בגרסה 2.0:
- התקנה חכמה ומהירה: אשף ההתקנה מזהה ומגדיר אוטומטית מפתחות API קיימים, מנויי Claude / ChatGPT ומודלים שמותקנים אצלכם מקומית, כדי שתוכלו להיכנס ישר לעבודה בלי להסתבך בהגדרות ידניות.
- ממשק דפדפן מחודש: אפליקציית Web חדשה שנפתחת ישירות לשיחה, כוללת חיפוש בהיסטוריית הצ'אטים, מעקב אחר התקדמות משימות, הזנה מאובטחת של פרטים רגישים (מוסווים) ואינטגרציה עמוקה יותר ל-Slack.
- מנגנון "חלומות" וזיכרון לטווח ארוך: הסוכן מסוגל לעבד מידע ברקע בזמן מנוחה, לגבש תובנות קריטיות לזיכרון ארוך-טווח, ולייצר לעצמו מיומנויות (סקילים) חדשות על בסיס דפוסי שימוש שחוזרים על עצמם.
- מולטי-טאסקינג ושליטה מלאה: מעבר חלק בין משימות שונות (למשל מעקב אחר תיבת מייל וחיפוש מידע במקביל), עבודה על Sessions משותפים, שליטה על שולחן העבודה, ואפילו הצטרפות ותמלול של שיחות זום/Teams.
- ייבוא מכלים מתחרים: אפשרות לייבא בקלות היסטוריה וזיכרונות קיימים ישירות מ-Claude Code, Codex ו-Hermes.
קישורים לכתבות בנושא:
https://www.geektime.co.il/openclaw-2-0-released/
https://www.gadgety.co.il/368309/openclaw-2-launched/
https://www.tgspot.co.il/openclaw-reached-version-2-0/ -
Anthropic משיקה את Claude Fable 5.1 – שדרוג משמעותי לסוכני AI
Anthropic השיקה את Claude Fable 5.1, שדרוג חדש למודל הדגל שלה, עם דגש חזק על סוכני AI, מחקר מדעי, כתיבת קוד ואוטומציה.
למרות שהשם נשמע כמו עדכון קטן של 0.1, לפי הנתונים שפרסמה החברה מדובר בקפיצה משמעותית – במיוחד במשימות ארוכות ומורכבות שמבוצעות על ידי סוכנים.
הביצועים
ב־Terminal-Bench-Science, המודל החדש הגיע ל־52.6% – שיפור משמעותי לעומת:
מודל תוצאה Claude Fable 5.1 52.6% Opus 5 29% Fable 5 24.7% GPT-5.6 Sol 22.4% בנוסף, Fable 5.1 הגיע ל־:
- 55.8% ב־Terminal-Bench 4.0.
- 73.4% ב־CursorBench.
- 31.4% ב־AutomationBench.
לא רק קוד
לפי Anthropic, השיפור אינו מוגבל למשימות תכנות. Fable 5.1 מציג ביצועים טובים יותר גם ב־:
- משימות ידע ומחקר.
- שימוש במחשב.
- חשיבה רב־תחומית.
- תהליכים עסקיים.
- אוטומציות ומשימות Agent ארוכות.
וגם המחיר יורד
לצד השיפור בביצועים, Anthropic טוענת שגם עלות העבודה עם המודל צפויה להיות נמוכה יותר.
- במשימות רגילות המחויבות לפי טוקנים – העלות צפויה להיות נמוכה בכ־25% לעומת Fable 5.
- במשימות סוכנים ארוכות ומורכבות – החיסכון עשוי להגיע לכ־45%.
בקיצור, Fable 5.1 אולי נשמע כמו עדכון גרסה קטן, אבל בפועל נראה שהשדרוג המרכזי נמצא בדיוק במקום שאליו התעשייה הולכת: סוכני AI שעובדים לאורך זמן ומבצעים משימות מורכבות ורב־שלביות.
https://www.anthropic.com/claude-fable-and-mythos-5-1

-
Anthropic משיקה את Claude Fable 5.1 – שדרוג משמעותי לסוכני AI
Anthropic השיקה את Claude Fable 5.1, שדרוג חדש למודל הדגל שלה, עם דגש חזק על סוכני AI, מחקר מדעי, כתיבת קוד ואוטומציה.
למרות שהשם נשמע כמו עדכון קטן של 0.1, לפי הנתונים שפרסמה החברה מדובר בקפיצה משמעותית – במיוחד במשימות ארוכות ומורכבות שמבוצעות על ידי סוכנים.
הביצועים
ב־Terminal-Bench-Science, המודל החדש הגיע ל־52.6% – שיפור משמעותי לעומת:
מודל תוצאה Claude Fable 5.1 52.6% Opus 5 29% Fable 5 24.7% GPT-5.6 Sol 22.4% בנוסף, Fable 5.1 הגיע ל־:
- 55.8% ב־Terminal-Bench 4.0.
- 73.4% ב־CursorBench.
- 31.4% ב־AutomationBench.
לא רק קוד
לפי Anthropic, השיפור אינו מוגבל למשימות תכנות. Fable 5.1 מציג ביצועים טובים יותר גם ב־:
- משימות ידע ומחקר.
- שימוש במחשב.
- חשיבה רב־תחומית.
- תהליכים עסקיים.
- אוטומציות ומשימות Agent ארוכות.
וגם המחיר יורד
לצד השיפור בביצועים, Anthropic טוענת שגם עלות העבודה עם המודל צפויה להיות נמוכה יותר.
- במשימות רגילות המחויבות לפי טוקנים – העלות צפויה להיות נמוכה בכ־25% לעומת Fable 5.
- במשימות סוכנים ארוכות ומורכבות – החיסכון עשוי להגיע לכ־45%.
בקיצור, Fable 5.1 אולי נשמע כמו עדכון גרסה קטן, אבל בפועל נראה שהשדרוג המרכזי נמצא בדיוק במקום שאליו התעשייה הולכת: סוכני AI שעובדים לאורך זמן ומבצעים משימות מורכבות ורב־שלביות.
https://www.anthropic.com/claude-fable-and-mythos-5-1

-
פוסט זה נמחק!
-
מטא משיקה את Muse Voice Transcribe – מודל תמלול קולי בזמן אמת
Meta השיקה את Muse Voice Transcribe, מודל חדש לתמלול קולי בזמן אמת שפותח ב־Meta Superintelligence Labs.
לפי מארק צוקרברג, המודל מיועד לתמלול רציף, ומשלב בתוך מודל אחד גם זיהוי דוברים שונים וגם זיהוי של הרגע שבו הדובר מסיים לדבר.
Adaptive Delay – המודל מחליט מתי לתמלל
אחת היכולות המעניינות במודל נקראת Adaptive Delay.
במקום להשתמש בהשהיה קבועה, המודל מחליט בעצמו כמה זמן להמתין לפני שהוא מקבע כל מילה:
- במילים מורכבות או לא ברורות הוא ממתין מעט יותר כדי לשפר את הדיוק.
- במילים פשוטות הוא מגיב מהר יותר.
כך הוא מנסה לשמור על איזון בין מהירות התמלול לדיוק.
תמיכה בשפות ובשיחות ארוכות
Muse Voice Transcribe אומן על יותר מ־70 שפות, כאשר 25 שפות עברו אימות לקראת ההשקה.
בנוסף, הוא תומך ב־:
- מעבר בין שפות באמצע משפט.
- שיחות שנמשכות שעות.
- יותר מ־20 דוברים בשיחה אחת.
איפה הוא זמין?
המודל כבר משמש את Meta עבור:
- הכתבה באפליקציית Meta למחשב.
- קלט קולי ב־Muse Code.
- שימוש דרך ה־API של Meta.
פרטיות:
ב־API קיימת גם אפשרות שבה המידע שנשלח למודל אינו נשמר.
שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.
נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.
בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗
הרשמה התחברות
