שיתוף | מה חדש בבינה מלאכותית - מתעדכן
-
inclusionAI - Ling 3.0 Tiny (8B A1B): המודל החזק ביותר שתוכלו להריץ על המחשב שלכם, במהירות גבוהה!
inclusionAI משחררת את המודל Ling 3.0 Tiny, הקטן ביותר בסדרת Ling 3.0.
שאר המודלים בסדרה פחות מעניינים ורלוונטיים, למרות שהם טובים בהחלט, אבל המודל המפתיע ביותר בסדרה הוא Ling 3.0 Tiny, מודל חשיבה בעל 8B פרמטרים כשרק 1.3B מופעלים עבור כל פרמטר, כך שהוא רץ כמעט במהירות של מודל 1B זעיר, אבל עם אינטליגנציה גבוהה מאוד ויכולות סוכן מטורפות. אני הצלחתי לקבל כ-19 טוקנים לשנייה ב-llama.cpp עם המודל הזה, עם 16 RAM בלבד במקביל לכ-900 כרטיסיות פתוחות בדפדפן...
המודל החדש מתמחה במיוחד בלולאות סוכן ובהפעלת כלים מרובים, עם יכולות היגיון וקידוד חזקות מאוד. עברית הוא דובר קצת פחות טוב, אבל עדיין מבין עברית מצוין.מדדים:
- אינטליגנציה:
שימו לב אילו מודלים חזקים הוא עוקף או משתווה אליהם!
החץ הסגול מדגים את הפער העצום מהמתחרה האמיתי של המודל החדש - LFM 2.5 8B A1B - מודל זהה בגודלו ובגודל הפרמטרים המופעלים.

- יכולות סוכן:
גם כאן, המודל החדש עוקף מודלים חזקים, כמו Gemma 4 31B עם חשיבה מופעלת!

המודל הושק כבר לפני שבוע, אבל עד אתמול לא נתמך ב-llama.cpp, ולכן ייקח זמן (כמה ימים) עד שייתמך בתוכנות המעטפת כמו LM Studio, אבל כבר עכשיו אפשר להשתמש בו בקלות עם llama.cpp. מקסימום תיעזרו ב-GPT...
- אינטליגנציה:
-
DeepSeek · DeepSeek V4 Flash Vision Exp
DeepSeek משיקה את המודל החדש: DeepSeek V4 Flash Vision Exp, גרסת מודל ראיה למודל החזק שלה - DeepSeek V4 Flash.
בנוסף ליכולות הראיה, המודל משתפר מאוד במרבית המדדים לעומת קודמו:

בין השיפורים:
• קלט טקסט ותמונה מקוריים מאפשרים לסוכנים לבדוק מצבי ממשק משתמש, צילומי מסך, תרשימים ופריטים חזותיים אחרים תוך כדי המשך השימוש בכלים.• DeepSeek מדווחת על שיפור משמעותי בהשוואה ל-V4 Flash במבחני ביצועים של סוכנים חזותיים, עם ביצועים קרובים ל-Opus 4.8; זוהי השוואה המנוהלת על ידי ספק.
• השלמות צ'אט, הודעות ותגובות נתמכות, כאשר תמונות מסופקות דרך base64, כתובות URL חיצוניות או מזהה קובץ של Files API.
• ממשק ה-API של קבצים מאפשר ליישומים להעלות תמונה פעם אחת ולעשות בה שימוש חוזר בבקשות שונות; תמונות מזהה קובץ יכולות להיות בגודל של עד 64 מגה-בייט לעומת 32 מגה-בייט עבור תמונות מוטבעות או תמונות URL.
DeepSeek מתייגת גרסה זו כניסיונית ולא כזמינה באופן כללי.
-
השבוע גוגל פרסמה שג'מה חוגגת מיליארד הורדות
-
Qwen - Qwen 3.8 Flash Next
Qwen מכריזה על השקת המודל החדש Qwen 3.8 Flash Next, מודל MoE המבוסס על ארכיטקטורת Qwen 4 העתידית, על מנת לאפשר לציבור להתאים לארכיטקטורה החדשה בהשקה המלאה של משפחת Qwen 4.
הארכיטקטורה החדשנית המשמשת במודל הזה, מתבססת בעצם על הטכנולוגיה שפותחה ע"י גוגל במודלי Gemma Edge (המודלים הקטנים של Gemma), E2B ו-E4B, שבה רק חלק מהפרמטרים הינם פרמטרים "אפקטיביים", כלומר רגילים בעלי יכולות היגיון והסקה, בעוד שאר הפרמטרים הם בעצם טבלת n_gram של פרמטרי הטמעה - כמו ספריית ידע צדדית שהמודל יכול לשלוף ממנה מידע, והיא אינה דורשת כוח עיבוד מיוחד ואפשר לטעון אותה אפילו לדיסק.
אז המודל החדש הוא 125B A6B - כלומר בעל 125B פרמטרים אפקטיביים - רגילים, כשמתוכם 6B פעילים עבור כל טוקן, בנוסף ל-51B פרמטרי הטמעה נפרדים, הניתנים לטעינה לדיסק.
הארכיטקטורה הזאת מאפשרת למודל להיות מהיר כמעט כמו מודל קטן של 6B בלבד, עם יכולות של 125B, וידע של עוד 51B בנוסף!
Qwen לא סיפקו מידע נוסף בנוגע למודלים הבאים של סדרת Qwen 4, והאם כולם יהיו בארכיטקטורה החדשה או רק חלקם.המודל ישוחרר במשקלים פתוחים מחר (רביעי) בשעה 18:00, ככל הנראה כאן:
https://huggingface.co/models/Qwen/Qwen3.8-Flash-Next -
מגבלת ה5 שעות בקודקס חזרה.

-
מגבלת ה5 שעות בקודקס חזרה.

-
IBM - Granite 4.2 3B/8B/30B
IBM משחררת את משפחת המודלים החדשה - Granite 4.2, עם 3 גדלי מודל - 3B, 8B ו-30B.
המודלים החדשים פחות חזקים בקידוד ממודלי החזית הבינוניים כמו Qwen 3.8 27B, אבל מתייחדים במערכי נתונים פתוחים, בהתחייבות של IBM שהמודלים לא עלולים לפלוט טקסטים הפוגעים בזכויות יוצרים (חיוני לעסקים וארגונים), וכן ביכולות RAG גבוהות וידע כללי.קישורים:
https://huggingface.co/ibm-granite/granite-4.2-3b-GGUF
https://huggingface.co/ibm-granite/granite-4.2-8b-GGUF
https://huggingface.co/ibm-granite/granite-4.2-30b-GGUF -
-
סוף סוף, המודל האנונימי שתפס כותרות בכל העולם OX ALPHA והיצרן שלו היה חסוי, התברר כ GLM 5.3 פלאש! שימו לב לכותרת בדף המודל באופן ראוטר
והמדדים שלו לא יאומנו! והמחיר עוד יותר לא יאומן כי יסופר
לא הצלחתי לצלם מסך אז העליתי קישורים
@א.מ.ד. לא האמנתי שאקדים אותך
אני בדרך כלל סומך עליך, וכמוני עוד רבים כנראה
שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.
נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.
בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗
הרשמה התחברות
