שיתוף | מה חדש בבינה מלאכותית - מתעדכן
-
פוסט זה נמחק!
-
Qwen - Qwen 3.8 27B
Qwen משחררת מודל פתוח חדש: Qwen 3.8 27B, אחיו הקטן של Qwen 3.8 2.4T ששוחרר ביום רביעי השבוע.
המודל מתאים להרצה מקומית על חומרה מתאימה.בין השיפורים העיקריים:
- יכולות ליבה: שיפורים מקיפים בקידוד, עבודה מקצועית, מחקר ומשימות ארוכות טווח.
- ביצועי סוכן: תכנון אוטונומי חזק יותר וטיפול טוב יותר במשוב סביבתי, המובילים להשלמת משימות אמינה יותר מקצה לקצה.
- תאימות במורד הזרם: תמיכה רחבה יותר עבור רתמות וכלי פיתוח פופולריים, מה שמקל על שילובן בסביבות הפיתוח הקיימות של המשתמש.
- בקרת חשיבה גמישה: מצב חשיבה מופעל כברירת מחדל וניתן להשבית אותו לפי בקשה; ניתן לכוונן את עומק החשיבה באמצעות
reasoning_effort, ולהגדיר שמירת בלוקי חשיבה מהודעות קודמות באמצעותpreserve_thinking. - הבנה ויזואלית-שפתית: תמיכה מקורית בהבנת תמונות ווידאו, החל מדיאגרמות ומסמכים של STEM ועד לסרטונים בקנה מידה של שעות.
קישור: https://huggingface.co/Qwen/Qwen3.8-27B (ישוחרר במשקלים פתוחים היום בשעה 18:00).
-
Z.ai - GLM-5.3
חברת Z.ai משיקה מודל חדש: GLM-5.3.
בין השיפורים העיקריים:
- קידוד חזק יותר: GLM-5.3 הוא מודל המשקלים הפתוחים היעיל ביותר לקידוד, עם שיפור של 50% לעומת GLM-5.2 ב-Z.ai Code Bench. הוא גם השיג ביצועי חזית בקוד פתוח במבחנים ציבוריים, כולל Terminal Bench 3.0 ו-Agents' Last Exam.
- יכולת סייבר מתפתחת: ככל שיכולות הסייבר הורחבו לאחר האימון, התפתחה יכולת הסייבר מהר יותר מהמצופה. GLM-5.3 הוא הטכנולוגיה המתקדמת ביותר ב-CyberGym לגילוי פגיעויות, והיתרונות שלו הם הגדולים ביותר בהמשך שרשרת הניצול, שם הוא יותר ממכפיל את מדדי GLM-5.2.
- משקלים פתוחים: המשקולות ישוחררו שבועיים לאחר ההשקה, לאחר השלמת הערכת הבטיחות וההקשחה.
המדדים, כפי שפורסמו ע"י Z.ai:

-
כעת תוכלו לחבר אפילו יותר מהאפליקציות והשירותים המועדפים עליכם ל-Gemini!!
היום ב-Made by Google, אנו מכריזים על מגוון חדש של אפליקציות מחוברות שמגיעות ל-Gemini כדי לעזור לכם להספיק יותר. על ידי הפעלת השירותים המועדפים עליכם ב-Gemini, תוכלו לתכנן, ליצור ולהתמודד בקלות עם רשימת המטלות שלכם, הכל במקום אחד.
במהלך השבועות הקרובים, אנו פורסים את היכולת להתחבר עם כלים במגוון קטגוריות:
פרודוקטיביות ויצירתיות: סיכמו פגישות וערו את אתר האינטרנט שלכם בעזרת Granola, Otter.ai ו-Wix.
מקומי ובידור: הזמינו חוויות מקומיות, שכרו רכב, הזמינו את ארוחת הערב הבאה שלכם וחפשו כרטיסים לאירועים עם Fever, GetYourGuide, Localiza, OpenTable (בריטניה) ו-Ticketmaster.
מוזיקה: גלו תחנות חדשות והזרימו את רשימות ההשמעה המועדפות עליכם עם iHeartRadio ו-Pandora.
בית, בריאות וסגנון חיים: מצאו איש מקצוע בתחום הבית עם Angi או Thumbtack או הזמינו תור לרופא עם Zocdoc. -
inclusionAI - Ling 3.0 Tiny (8B A1B): המודל החזק ביותר שתוכלו להריץ על המחשב שלכם, במהירות גבוהה!
inclusionAI משחררת את המודל Ling 3.0 Tiny, הקטן ביותר בסדרת Ling 3.0.
שאר המודלים בסדרה פחות מעניינים ורלוונטיים, למרות שהם טובים בהחלט, אבל המודל המפתיע ביותר בסדרה הוא Ling 3.0 Tiny, מודל חשיבה בעל 8B פרמטרים כשרק 1.3B מופעלים עבור כל פרמטר, כך שהוא רץ כמעט במהירות של מודל 1B זעיר, אבל עם אינטליגנציה גבוהה מאוד ויכולות סוכן מטורפות. אני הצלחתי לקבל כ-19 טוקנים לשנייה ב-llama.cpp עם המודל הזה, עם 16 RAM בלבד במקביל לכ-900 כרטיסיות פתוחות בדפדפן...
המודל החדש מתמחה במיוחד בלולאות סוכן ובהפעלת כלים מרובים, עם יכולות היגיון וקידוד חזקות מאוד. עברית הוא דובר קצת פחות טוב, אבל עדיין מבין עברית מצוין.מדדים:
- אינטליגנציה:
שימו לב אילו מודלים חזקים הוא עוקף או משתווה אליהם!
החץ הסגול מדגים את הפער העצום מהמתחרה האמיתי של המודל החדש - LFM 2.5 8B A1B - מודל זהה בגודלו ובגודל הפרמטרים המופעלים.

- יכולות סוכן:
גם כאן, המודל החדש עוקף מודלים חזקים, כמו Gemma 4 31B עם חשיבה מופעלת!

המודל הושק כבר לפני שבוע, אבל עד אתמול לא נתמך ב-llama.cpp, ולכן ייקח זמן (כמה ימים) עד שייתמך בתוכנות המעטפת כמו LM Studio, אבל כבר עכשיו אפשר להשתמש בו בקלות עם llama.cpp. מקסימום תיעזרו ב-GPT...
- אינטליגנציה:
-
DeepSeek · DeepSeek V4 Flash Vision Exp
DeepSeek משיקה את המודל החדש: DeepSeek V4 Flash Vision Exp, גרסת מודל ראיה למודל החזק שלה - DeepSeek V4 Flash.
בנוסף ליכולות הראיה, המודל משתפר מאוד במרבית המדדים לעומת קודמו:

בין השיפורים:
• קלט טקסט ותמונה מקוריים מאפשרים לסוכנים לבדוק מצבי ממשק משתמש, צילומי מסך, תרשימים ופריטים חזותיים אחרים תוך כדי המשך השימוש בכלים.• DeepSeek מדווחת על שיפור משמעותי בהשוואה ל-V4 Flash במבחני ביצועים של סוכנים חזותיים, עם ביצועים קרובים ל-Opus 4.8; זוהי השוואה המנוהלת על ידי ספק.
• השלמות צ'אט, הודעות ותגובות נתמכות, כאשר תמונות מסופקות דרך base64, כתובות URL חיצוניות או מזהה קובץ של Files API.
• ממשק ה-API של קבצים מאפשר ליישומים להעלות תמונה פעם אחת ולעשות בה שימוש חוזר בבקשות שונות; תמונות מזהה קובץ יכולות להיות בגודל של עד 64 מגה-בייט לעומת 32 מגה-בייט עבור תמונות מוטבעות או תמונות URL.
DeepSeek מתייגת גרסה זו כניסיונית ולא כזמינה באופן כללי.
-
השבוע גוגל פרסמה שג'מה חוגגת מיליארד הורדות
-
Qwen - Qwen 3.8 Flash Next
Qwen מכריזה על השקת המודל החדש Qwen 3.8 Flash Next, מודל MoE המבוסס על ארכיטקטורת Qwen 4 העתידית, על מנת לאפשר לציבור להתאים לארכיטקטורה החדשה בהשקה המלאה של משפחת Qwen 4.
הארכיטקטורה החדשנית המשמשת במודל הזה, מתבססת בעצם על הטכנולוגיה שפותחה ע"י גוגל במודלי Gemma Edge (המודלים הקטנים של Gemma), E2B ו-E4B, שבה רק חלק מהפרמטרים הינם פרמטרים "אפקטיביים", כלומר רגילים בעלי יכולות היגיון והסקה, בעוד שאר הפרמטרים הם בעצם טבלת n_gram של פרמטרי הטמעה - כמו ספריית ידע צדדית שהמודל יכול לשלוף ממנה מידע, והיא אינה דורשת כוח עיבוד מיוחד ואפשר לטעון אותה אפילו לדיסק.
אז המודל החדש הוא 125B A6B - כלומר בעל 125B פרמטרים אפקטיביים - רגילים, כשמתוכם 6B פעילים עבור כל טוקן, בנוסף ל-51B פרמטרי הטמעה נפרדים, הניתנים לטעינה לדיסק.
הארכיטקטורה הזאת מאפשרת למודל להיות מהיר כמעט כמו מודל קטן של 6B בלבד, עם יכולות של 125B, וידע של עוד 51B בנוסף!
Qwen לא סיפקו מידע נוסף בנוגע למודלים הבאים של סדרת Qwen 4, והאם כולם יהיו בארכיטקטורה החדשה או רק חלקם.המודל ישוחרר במשקלים פתוחים מחר (רביעי) בשעה 18:00, ככל הנראה כאן:
https://huggingface.co/models/Qwen/Qwen3.8-Flash-Next -
מגבלת ה5 שעות בקודקס חזרה.

-
מגבלת ה5 שעות בקודקס חזרה.

שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.
נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.
בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗
הרשמה התחברות