שיתוף | מה חדש בבינה מלאכותית - מתעדכן
-
-
פוסט זה נמחק!
-
Qwen - Qwen 3.8 27B
Qwen משחררת מודל פתוח חדש: Qwen 3.8 27B, אחיו הקטן של Qwen 3.8 2.4T ששוחרר ביום רביעי השבוע.
המודל מתאים להרצה מקומית על חומרה מתאימה.בין השיפורים העיקריים:
- יכולות ליבה: שיפורים מקיפים בקידוד, עבודה מקצועית, מחקר ומשימות ארוכות טווח.
- ביצועי סוכן: תכנון אוטונומי חזק יותר וטיפול טוב יותר במשוב סביבתי, המובילים להשלמת משימות אמינה יותר מקצה לקצה.
- תאימות במורד הזרם: תמיכה רחבה יותר עבור רתמות וכלי פיתוח פופולריים, מה שמקל על שילובן בסביבות הפיתוח הקיימות של המשתמש.
- בקרת חשיבה גמישה: מצב חשיבה מופעל כברירת מחדל וניתן להשבית אותו לפי בקשה; ניתן לכוונן את עומק החשיבה באמצעות
reasoning_effort, ולהגדיר שמירת בלוקי חשיבה מהודעות קודמות באמצעותpreserve_thinking. - הבנה ויזואלית-שפתית: תמיכה מקורית בהבנת תמונות ווידאו, החל מדיאגרמות ומסמכים של STEM ועד לסרטונים בקנה מידה של שעות.
קישור: https://huggingface.co/Qwen/Qwen3.8-27B (ישוחרר במשקלים פתוחים היום בשעה 18:00).
-
Z.ai - GLM-5.3
חברת Z.ai משיקה מודל חדש: GLM-5.3.
בין השיפורים העיקריים:
- קידוד חזק יותר: GLM-5.3 הוא מודל המשקלים הפתוחים היעיל ביותר לקידוד, עם שיפור של 50% לעומת GLM-5.2 ב-Z.ai Code Bench. הוא גם השיג ביצועי חזית בקוד פתוח במבחנים ציבוריים, כולל Terminal Bench 3.0 ו-Agents' Last Exam.
- יכולת סייבר מתפתחת: ככל שיכולות הסייבר הורחבו לאחר האימון, התפתחה יכולת הסייבר מהר יותר מהמצופה. GLM-5.3 הוא הטכנולוגיה המתקדמת ביותר ב-CyberGym לגילוי פגיעויות, והיתרונות שלו הם הגדולים ביותר בהמשך שרשרת הניצול, שם הוא יותר ממכפיל את מדדי GLM-5.2.
- משקלים פתוחים: המשקולות ישוחררו שבועיים לאחר ההשקה, לאחר השלמת הערכת הבטיחות וההקשחה.
המדדים, כפי שפורסמו ע"י Z.ai:

-
כעת תוכלו לחבר אפילו יותר מהאפליקציות והשירותים המועדפים עליכם ל-Gemini!!
היום ב-Made by Google, אנו מכריזים על מגוון חדש של אפליקציות מחוברות שמגיעות ל-Gemini כדי לעזור לכם להספיק יותר. על ידי הפעלת השירותים המועדפים עליכם ב-Gemini, תוכלו לתכנן, ליצור ולהתמודד בקלות עם רשימת המטלות שלכם, הכל במקום אחד.
במהלך השבועות הקרובים, אנו פורסים את היכולת להתחבר עם כלים במגוון קטגוריות:
פרודוקטיביות ויצירתיות: סיכמו פגישות וערו את אתר האינטרנט שלכם בעזרת Granola, Otter.ai ו-Wix.
מקומי ובידור: הזמינו חוויות מקומיות, שכרו רכב, הזמינו את ארוחת הערב הבאה שלכם וחפשו כרטיסים לאירועים עם Fever, GetYourGuide, Localiza, OpenTable (בריטניה) ו-Ticketmaster.
מוזיקה: גלו תחנות חדשות והזרימו את רשימות ההשמעה המועדפות עליכם עם iHeartRadio ו-Pandora.
בית, בריאות וסגנון חיים: מצאו איש מקצוע בתחום הבית עם Angi או Thumbtack או הזמינו תור לרופא עם Zocdoc. -
inclusionAI - Ling 3.0 Tiny (8B A1B): המודל החזק ביותר שתוכלו להריץ על המחשב שלכם, במהירות גבוהה!
inclusionAI משחררת את המודל Ling 3.0 Tiny, הקטן ביותר בסדרת Ling 3.0.
שאר המודלים בסדרה פחות מעניינים ורלוונטיים, למרות שהם טובים בהחלט, אבל המודל המפתיע ביותר בסדרה הוא Ling 3.0 Tiny, מודל חשיבה בעל 8B פרמטרים כשרק 1.3B מופעלים עבור כל פרמטר, כך שהוא רץ כמעט במהירות של מודל 1B זעיר, אבל עם אינטליגנציה גבוהה מאוד ויכולות סוכן מטורפות. אני הצלחתי לקבל כ-19 טוקנים לשנייה ב-llama.cpp עם המודל הזה, עם 16 RAM בלבד במקביל לכ-900 כרטיסיות פתוחות בדפדפן...
המודל החדש מתמחה במיוחד בלולאות סוכן ובהפעלת כלים מרובים, עם יכולות היגיון וקידוד חזקות מאוד. עברית הוא דובר קצת פחות טוב, אבל עדיין מבין עברית מצוין.מדדים:
- אינטליגנציה:
שימו לב אילו מודלים חזקים הוא עוקף או משתווה אליהם!
החץ הסגול מדגים את הפער העצום מהמתחרה האמיתי של המודל החדש - LFM 2.5 8B A1B - מודל זהה בגודלו ובגודל הפרמטרים המופעלים.

- יכולות סוכן:
גם כאן, המודל החדש עוקף מודלים חזקים, כמו Gemma 4 31B עם חשיבה מופעלת!

המודל הושק כבר לפני שבוע, אבל עד אתמול לא נתמך ב-llama.cpp, ולכן ייקח זמן (כמה ימים) עד שייתמך בתוכנות המעטפת כמו LM Studio, אבל כבר עכשיו אפשר להשתמש בו בקלות עם llama.cpp. מקסימום תיעזרו ב-GPT...
- אינטליגנציה:
-
DeepSeek · DeepSeek V4 Flash Vision Exp
DeepSeek משיקה את המודל החדש: DeepSeek V4 Flash Vision Exp, גרסת מודל ראיה למודל החזק שלה - DeepSeek V4 Flash.
בנוסף ליכולות הראיה, המודל משתפר מאוד במרבית המדדים לעומת קודמו:

בין השיפורים:
• קלט טקסט ותמונה מקוריים מאפשרים לסוכנים לבדוק מצבי ממשק משתמש, צילומי מסך, תרשימים ופריטים חזותיים אחרים תוך כדי המשך השימוש בכלים.• DeepSeek מדווחת על שיפור משמעותי בהשוואה ל-V4 Flash במבחני ביצועים של סוכנים חזותיים, עם ביצועים קרובים ל-Opus 4.8; זוהי השוואה המנוהלת על ידי ספק.
• השלמות צ'אט, הודעות ותגובות נתמכות, כאשר תמונות מסופקות דרך base64, כתובות URL חיצוניות או מזהה קובץ של Files API.
• ממשק ה-API של קבצים מאפשר ליישומים להעלות תמונה פעם אחת ולעשות בה שימוש חוזר בבקשות שונות; תמונות מזהה קובץ יכולות להיות בגודל של עד 64 מגה-בייט לעומת 32 מגה-בייט עבור תמונות מוטבעות או תמונות URL.
DeepSeek מתייגת גרסה זו כניסיונית ולא כזמינה באופן כללי.
-
השבוע גוגל פרסמה שג'מה חוגגת מיליארד הורדות
-
Qwen - Qwen 3.8 Flash Next
Qwen מכריזה על השקת המודל החדש Qwen 3.8 Flash Next, מודל MoE המבוסס על ארכיטקטורת Qwen 4 העתידית, על מנת לאפשר לציבור להתאים לארכיטקטורה החדשה בהשקה המלאה של משפחת Qwen 4.
הארכיטקטורה החדשנית המשמשת במודל הזה, מתבססת בעצם על הטכנולוגיה שפותחה ע"י גוגל במודלי Gemma Edge (המודלים הקטנים של Gemma), E2B ו-E4B, שבה רק חלק מהפרמטרים הינם פרמטרים "אפקטיביים", כלומר רגילים בעלי יכולות היגיון והסקה, בעוד שאר הפרמטרים הם בעצם טבלת n_gram של פרמטרי הטמעה - כמו ספריית ידע צדדית שהמודל יכול לשלוף ממנה מידע, והיא אינה דורשת כוח עיבוד מיוחד ואפשר לטעון אותה אפילו לדיסק.
אז המודל החדש הוא 125B A6B - כלומר בעל 125B פרמטרים אפקטיביים - רגילים, כשמתוכם 6B פעילים עבור כל טוקן, בנוסף ל-51B פרמטרי הטמעה נפרדים, הניתנים לטעינה לדיסק.
הארכיטקטורה הזאת מאפשרת למודל להיות מהיר כמעט כמו מודל קטן של 6B בלבד, עם יכולות של 125B, וידע של עוד 51B בנוסף!
Qwen לא סיפקו מידע נוסף בנוגע למודלים הבאים של סדרת Qwen 4, והאם כולם יהיו בארכיטקטורה החדשה או רק חלקם.מדדים - בהמשך השרשור.
קישור:
https://huggingface.co/models/Qwen/Qwen3.8-Flash-Next -
מגבלת ה5 שעות בקודקס חזרה.

-
מגבלת ה5 שעות בקודקס חזרה.

-
IBM - Granite 4.2 3B/8B/30B
IBM משחררת את משפחת המודלים החדשה - Granite 4.2, עם 3 גדלי מודל - 3B, 8B ו-30B.
המודלים החדשים פחות חזקים בקידוד ממודלי החזית הבינוניים כמו Qwen 3.8 27B, אבל מתייחדים במערכי נתונים פתוחים, בהתחייבות של IBM שהמודלים לא עלולים לפלוט טקסטים הפוגעים בזכויות יוצרים (חיוני לעסקים וארגונים), וכן ביכולות RAG גבוהות וידע כללי.קישורים:
https://huggingface.co/ibm-granite/granite-4.2-3b-GGUF
https://huggingface.co/ibm-granite/granite-4.2-8b-GGUF
https://huggingface.co/ibm-granite/granite-4.2-30b-GGUF -
-
סוף סוף, המודל האנונימי שתפס כותרות בכל העולם OX ALPHA והיצרן שלו היה חסוי, התברר כ GLM 5.3 פלאש! שימו לב לכותרת בדף המודל באופן ראוטר
והמדדים שלו לא יאומנו! והמחיר עוד יותר לא יאומן כי יסופר
לא הצלחתי לצלם מסך אז העליתי קישורים
@א.מ.ד. לא האמנתי שאקדים אותך
אני בדרך כלל סומך עליך, וכמוני עוד רבים כנראה -
גוגל משיקה את Gemini 3.5 Transcribe, מודל המרת דיבור לטקסט
גוגל השיקה ביום רביעי את Gemini 3.5 Transcribe, מודל המרת דיבור לטקסט המיועד לתמלול בזמן אמת, עם דיוק משופר וזמן תגובה מופחת בהשוואה לגרסתו הקודמת.
המודל ממיר שמע לטקסט מעוצב ומתמודד עם רעשי רקע, מינוח טכני ותיקונים של הדובר. Gemini 3.5 Transcribe משיג שיעור שגיאות מילים של 4.0% בתמלול סטרימינג ו-2.6% ביישומים שאינם סטרימינג, על פי מדידות של Artificial Analysis. הטכנולוגיה משפרת את זמן ההגעה לתמלול הסופי ב-70% לעומת מודל Chirp 3 הקודם.
גוגל מעמידה את המודל לשימוש דרך שני ממשקי תכנות יישומים. אפשרות הסטרימינג בזמן אמת מספקת זמן תגובה של פחות משנייה דרך Live API תוך שימוש ב-gemini-3.5-transcribe-live. אפשרות עיבוד השמע המוקלט מראש מתמללת פגישות ויומני שיחות עם ייחוס לדוברים דרך Interactions API תוך שימוש ב-gemini-3.5-transcribe.
המודל תומך בזיהוי ותמלול אוטומטי של למעלה מ-85 שפות ומזהה עד שלושה דוברים בשמע מוקלט מראש עם חותמות זמן. בין התכונות: הסרת מילות מילוי, עיצוב טקסט אוטומטי וזיהוי אוצר מילים מותאם אישית למינוח מקצועי. במדד הייחוס FLEURS, Gemini 3.5 Transcribe משיג שיעור שגיאות מילים של 5.50% במצב סטרימינג ו-5.04% בשימושים שאינם סטרימינג.
גוגל משלבת את הטכנולוגיה במוצרים שונים, ובהם אפליקציית Gemini ב-macOS, תכונת Rambler באנדרואיד דרך Gboard ו-Google AI Studio. המודל נכנס לתצוגה מקדימה ציבורית למפתחים דרך Google AI Studio ולארגונים דרך Gemini Enterprise Agent Platform. Chrome יקבל את יכולת הכתיב בעתיד.
-
גוגל מציגה את GlucoFM – מודל בסיס לנתוני ניטור סוכר רציף
Google Research הציגה את GlucoFM, מודל Foundation חדש שנבנה במיוחד לעבודה עם נתונים ממערכות ניטור סוכר רציף (CGM).
במקום להתייחס למדידות הסוכר כרצף נתונים אחד, GlucoFM מפריד אותן לשני סוגי מידע:
- State – מגמות הסוכר האיטיות והמתמשכות.
- Event – שינויים וקפיצות קצרות טווח, למשל סביב ארוחות.
ההפרדה הזו מאפשרת למודל ללמוד בצורה טובה יותר גם את המצב הבסיסי של רמות הסוכר וגם אירועים נקודתיים.
מה אפשר לעשות עם המודל?
לפי המחקר של Google, ניתן להשתמש ב־GlucoFM למגוון משימות, בהן:
- הערכת סיכון לסוכרת.
- זיהוי עמידות לאינסולין.
- חיזוי תגובת הסוכר לאחר ארוחה.
- זיהוי דפוסים ומצבים נוספים מתוך נתוני CGM.
בבדיקות שערכה Google, המודל הציג ביצועים טובים יותר ממודלים קיימים ברוב ההשוואות שנבדקו.
למה זה מעניין?
זו עוד דוגמה לאופן שבו מודלי Foundation מתרחבים מעבר לטקסט, תמונות וקוד – ומתחילים להתמחות גם בסוגי מידע רפואיים מאוד ספציפיים.
מדובר במודל מחקרי ובתוצאות מחקר, ולא בכלי שמחליף אבחון או ייעוץ רפואי.
למחקר ולפרטים נוספים
https://research.google/blog/glucofm-foundation-model-for-continuous-glucose-monitoring/

-
מדדי Qwen 3.8 Flash Next:
-
אינטליגנציה כללית:

משתווה ל-Gemini 3.7 Flash עם חשיבה חזקה, ול-GPT 5.5 עם חשיבה אקסטרה-חזקה. -
יכולות סוכן:

משתווה לקלוד אופוס 5 עם חשיבה חזקה, ועוקף את GPT 5.6 Sol עם חשיבה אקסטרה-חזקה!!!
ומה שהכי מפתיע, זה העובדה שמדובר במודל עם 125B פרמטרים בסך הכל, עם רק 6B פעילים! הארכיטקטורה החדשה של Qwen 4 מתבררת ככל הנראה כשינוי המבטיח שיאפשר הרצת מודלי-על על חומרה צרכנית עם GPU קטן...
> @אמיץ כתב בשיתוף | מה חדש בבינה מלאכותית - מתעדכן:
@א.מ.ד. לא האמנתי שאקדים אותך אני בדרך כלל סומך עליך, וכמוני עוד רבים כנראה
גם אם אני רואה מיד, לא תמיד אני ליד המחשב בשביל לפרסם...
-
-
גוגל משיקה את Gemini Omni 1.1 Flash – מודל ליצירה ולעריכת וידאו
גוגל השיקה את Gemini Omni 1.1 Flash, מודל ייעודי ליצירה ועריכה של וידאו שמתמקד במתן כלי שליטה מדויקים יותר למפתחים וליוצרים.
במקום להתמקד רק ביצירת וידאו מטקסט חופשי, המודל מציע סט כלים שנועד לפתור בעיות נפוצות כמו חוסר עקביות בין שוטים ובזבוז משאבים על טיוטות.
היכולות המרכזיות של המודל
- הגדרת פריים פתיחה וסיום: מאפשר לקבוע נקודת התחלה וסיום מדויקות לצילום, כשהמודל משלים את התנועה הרציפה ביניהן. מתאים במיוחד לתנועות מצלמה מורכבות, זום ולופים.
- הארכת סצנות: ניתוח של עד 10 שניות מצילום קודם כדי להמשיך את הסצנה ברצף, תוך שמירה על עקביות הדמויות, התאורה והקונטקסט.
- הזנת וידאו כרפרנס: שילוב של עד 3 שניות וידאו כקלט למיפוי תנועה, סגנון ושמירה על נראות הדמויות.
- תהליך עבודה חסכוני (טיוטה לשדרוג): יצירת בדיקות מהירות ברזולוציית 360p בעלות נמוכה, עם אפשרות לשדרג (Upscale) את התוצאות הנבחרות ל-720p, 1080p ועד 4K.
זמינות וגישה
- למפתחים: זמין כעת ב-Google AI Studio, ב-Flow ובפלטפורמת Gemini Enterprise Agent.
- למשתמשים: תכונת הארכת הסצנות פתוחה באפליקציית Gemini למנויי Google AI (במסלולי Plus, Pro ו-Ultra).
שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.
נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.
בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗
הרשמה התחברות


