שיתוף | מה חדש בבינה מלאכותית - מתעדכן
-
בריחת המודלים: האם אירגיולר למדה את הלקח?
סיכום AI (של כלכליסט)
טעות הגדרה בודדת במערכות של חברת הסייבר אירגיולר אפשרה למודלי בינה מלאכותית של חברות הטכנולוגיה הגדולות לפרוץ מסביבת הבדיקה ולתקוף מערכות חיצוניות.
שורת הפרסומים המדאיגים בשבועות האחרונים נובעת מדיווחים נפרדים של הלקוחות על אותה תקלה טכנית שטופלה ועודכנה כבר בסוף חודש יולי.
למרות התקריות המביכות, יחסי העבודה של החברה עם ענקיות הטכנולוגיה נמשכים כסדרם, תוך התמקדות בשיפור כלי האבטחה למניעת נזקים עתידיים ממודלים חזקים יותר.
מייסד החברה הבהיר כי מדובר בלמידה הכרחית בתחום טכנולוגי חדשני, וכי כל הליקויים הידועים בצד החברה נפתרו בתיאום עם הגורמים הרלוונטיים.השבועות האחרונים לא היו קלים בעבור אירגיולר (Irregular), חברת הסייבר הישראלית המוערכת. המערכת שמספקת החברה למעבדות AI לצורך בדיקת מודלים עמדה בלב תקריות שבהן המודלים פרצו מסביבת הבדיקה ותקפו מטרות באינטרנט הפתוח. אנתרופיק, OpenAI, מטא ובסוף השבוע גם גוגל.
בכל המקרים, טעות הגדרה במערכת של אירגיולר אפשרה למודלים גישה לאינטרנט הפתוח (בניגוד לתקרית פריצת המודלים הראשונה, שבה מודלים של OpenAI תקפו את פלטפורמת האגינג פייס, ושאינה קשורה לאנתרופיק, במקרים אלו המודלים לא הבינו שהם פועלים באינטרנט הפתוח). התוצאות היו תקיפה, לעתים בהצלחה, של מערכות מחשוב שונות.
במקרה העדכני, שהתרחש במאי, המודל של גוגל פרץ לשלוש מערכות מחשוב פרטיות נפרדות: פעם אחת באמצעות ניחוש ססמאות, ופעמיים נוספות תוך שימוש במאגר ססמאות שפורסם באופן פומבי. האירוע קרה במסגרת מבחן אבטחה שהופעל על ידי אירגיולר.
האזכור החוזר ונשנה של שמה של אירגיולר בהקשר של תקריות אלו עלול לייצר רושם שהחברה הישראלית מתמודדת עם תשתית ותרבות עבודה לקויות, שגורמות למערכות שלה לסבול מתקלות מביכות חוזרות ונשנות. אבל המציאות היא שכל התקריות המדוברות מקורן בתקלה אחת, טעות בהגדרות סביבת הבדיקה שמספקת אירגיולר ללקוחותיה, שתוקנה לפני שבועות.
הסיבה שנראה שמדובר באירוע מתמשך ובשורת תקלות מתגלגלות היא שהחברות השונות שהתמודדו עם התקלה מדווחות על הממצאים שלהן בלוחות זמנים נפרדים, מה שעלול לייצר רושם מוטעה. אירגיולר עצמה היא יותר נוסעת מאשר נהגת באירוע זה. לחברה הסכמי סודיות קפדניים עם החברות הגדולות שאיתן היא עובדת, וכתוצאה יכולתה לחשוף פרטים על לקוחות או התקשרויות מוגבלת.
עם זיהוי התקלה, ב-29 ביולי, היא תיקנה אותה ועדכנה את לקוחותיה, אך מעבר לכך לא יכלה לחשוף מידע פומבי באופן עצמאי אלא רק בתיאום עם החברה הרלוונטית, לפי לוח הזמנים שלה. התוצאה היא שורה של חשיפות מביכות על תקלות שבהן מעורבת החברה, כאשר בפועל מדובר בביטויים שונים של אותה תקלה, שהתרחשו באותה תקופת זמן וטופלו כבר לפני חודשים.
התקלה לא השפיעה על יחסי העבודה של אירגיולר עם חברות ה-AI, והיא ממשיכה לעבוד אתן הן לחקירת התקרית והן באופן שוטף באספקת סביבות בדיקה מאובטחות ומבחני הערכת ביצועים למודלים. "חשוב להבין שכאשר עושים דברים כאלה שהם בקצה היכולות הטכנולוגיות הקיימות כיום יש טעויות ורק מחפשים איך עושים טוב יותר", אמר לכלכליסט באוגוסט מייסד אירגיולר, עומר נבו, "עשינו תחקור של מה שקרה ומה היו כל ההשפעות ויש לנו עוד הרבה מה לשפר. יש עוד עבודה מחקרית עם המעבדות של החברות לייצר כלים מתאימים למניעת נזק. הפוקוס אצלנו עושה את המעבר מלהבין מה קרה ללהבין איך עוזרים לתעשייה להיערך ככל שהמודלים יהיו יותר חזקים".
תוקפה הצהרה זו לא השתנה גם עתה, לאחר פרסום התקרית עם גוגל, שכבר היתה מוכרת לשתי החברות מזה שבועות. המבחן האמיתי של אירגיולר הוא לא סביב השאלה האם יתפרסמו דיווחים על תקריות עבר נוספות שנובעות מאותה טעות הגדרה, אלא האם החברה למדה את הלקח וביצעה את השינויים הדרושים על מנת להימנע מתקלות אחרות שיביאו לתקריות חדשות.
מאירגיולר נמסר בתגובה: "מדובר באותו אירוע נקודתי שכבר דווח בעבר, ולא באירוע נפרד ומהותי. כל מעבדות ה-AI הרלוונטיות עודכנו בסוף יולי, ובמסגרת בדיקת האירוע נוצר קשר גם עם הגורמים שהושפעו ממנו. אירגיולר פעלה באופן מיידי, וכל הבעיות הידועות שהיו בצד שלנו טופלו ונפתרו כבר לפני מספר שבועות". -
Qwen (Alibaba) · Qwen Image 2.1
חברת Qwen שחררה את Qwen-Image-2.1, מודל קומפקטי ליצירה ועריכה של תמונות, המאפשר הפקת נכסים שקופים (RGBA), עריכה מבוססת מספר תמונות רפרנס (multi-reference), ותהליכי הפקה ויזואליים מעשיים יותר בעלויות הסקה נמוכות יותר.
• יצירה ועריכה טבעית בפורמט RGBA שקוף: מאפשרת להפיק בקלות מדבקות, אלמנטים בשכבות וחיתוכים (cutouts) ללא צורך בתהליך עבודה נפרד להסרת רקע.
• עריכה מתקדמת: תומכת בשימוש בעד 10 תמונות רפרנס לצד סימוני עיגול מקומיים, שרבוטי הערות (painted annotations) או מסכות — מה שמאפשר עריכת מוצרים, דיוקנאות ותמונות קבוצתיות תוך שמירה על זהות האובייקט (identity-preserving).
• תהליך עבודה מאוחד ליצירה ועריכה: תומך הן ביצירת תמונות מהנחיות טקסט (prompts) והן בשינוי תמונות קיימות, ובכך מצמצם את הצורך במעבר בין כלים שונים בצינורות הפקת התוכן הוויזואלי.
• ארכיטקטורה יעילה: Qwen מתארת רכיב יצירה ויזואלי בגודל 7B הכולל מנגנון קשב ברמות פירוט מעורבות (mixed-granularity attention) ושימוש חוזר ב-prefix KV-cache, המקריב מעט מגודל המודל לטובת הרצה מקומית יעילה יותר.
• רישוי וזמינות: המודל פועל תחת רישיון המחקר של Qwen (Qwen Research License) ואינו זמין כרגע דרך ספקי ההסקה של Hugging Face (Inference Providers). לפיכך, שימוש מסחרי וגישה מנוהלת דורשים בדיקה של תנאי הרישיון והסדרת אחסון עצמאי (self-hosting) או נתיב פריסה חלופי.מדדים:

קישורים:
- בלוג השחרור:
https://qwen.ai/blog?id=qwen-image-2.1 - קישור למאגר המודל ב-HF:
https://huggingface.co/Qwen/Qwen-Image-2.1
- בלוג השחרור:
-
Xiaomi MiMo · MiMo V2.6
Xiaomi MiMo - חטיבת ה-AI של Xiaomi (שיאומי), משחררת את משפחת המודלים החדשה MiMo V2.6.
בסדרת המודלים ישנם 3 מודלים בגדלים שונים:- MiMo V2.6 Pro RL: מודל הדגל של הסדרה. בעל 1.02T פרמטרים, עם 42B פרמטרים פעילים עבור כל טוקן.
- MiMo V2.6 Flash RL: מודל הביניים המהיר יותר. בעל 309B פרמטרים בסה"כ, עם 15B פעילים.
- MiMo V2.6 Distill Qwen 9B: זיקוק של מודל ה-Pro לתוך Qwen 3.5 9B.
מדדים:


-
Anthropic · Claude Opus 5.5 - פרטים נוספים
אנת'רופיק שחררה את Claude Opus 5.5, עדכון משמעותי למודל המוביל שלה שמיועד למשימות היגיון מורכבות, קידוד ולולאות סוכן ממושכות.
מעבר לשיפור היכולות, הדגש המרכזי כאן הוא הוזלה משמעותית במחיר ושיפור יציבות ההקשר.
עיקרי השיפורים:
- יציבות בהקשרים ארוכים וסוכנים: שיפור ניכר במניעת "קריסת היגיון" בלולאות חשיבה מרובות שלבים. המודל שומר על יציבות בעריכת קבצים מרובים במקביל ופתרון שגיאות בריצות ארוכות.
- מפרט טכני: חלון הקשר של 1 מיליון טוקנים, עם תמיכה בעד 128,000 טוקני פלט ויכולות ניתוח תמונה מובנות.
- הוזלת עלויות: תמחור ה-API ירד ל-$4 למיליון טוקנים קלט ו-$20 לפלט (כ-20% פחות מ-Opus 5). קריאה מזיכרון מטמון עומדת על $0.20 למיליון טוקנים.
- זמינות: המודל זמין כעת דרך ה-API, בממשקי Claude וב-Claude Code, וכן בפלטפורמות ענן (AWS Bedrock, Google Cloud ועוד).
מדדים:

קישור לדף המודל:
https://platform.claude.com/docs/en/models/opus-5-5/overview -
א אברהם גלסר התייחס לנושא זה
-
Anthropic · Claude Opus 5.5 - פרטים נוספים
אנת'רופיק שחררה את Claude Opus 5.5, עדכון משמעותי למודל המוביל שלה שמיועד למשימות היגיון מורכבות, קידוד ולולאות סוכן ממושכות.
מעבר לשיפור היכולות, הדגש המרכזי כאן הוא הוזלה משמעותית במחיר ושיפור יציבות ההקשר.
עיקרי השיפורים:
- יציבות בהקשרים ארוכים וסוכנים: שיפור ניכר במניעת "קריסת היגיון" בלולאות חשיבה מרובות שלבים. המודל שומר על יציבות בעריכת קבצים מרובים במקביל ופתרון שגיאות בריצות ארוכות.
- מפרט טכני: חלון הקשר של 1 מיליון טוקנים, עם תמיכה בעד 128,000 טוקני פלט ויכולות ניתוח תמונה מובנות.
- הוזלת עלויות: תמחור ה-API ירד ל-$4 למיליון טוקנים קלט ו-$20 לפלט (כ-20% פחות מ-Opus 5). קריאה מזיכרון מטמון עומדת על $0.20 למיליון טוקנים.
- זמינות: המודל זמין כעת דרך ה-API, בממשקי Claude וב-Claude Code, וכן בפלטפורמות ענן (AWS Bedrock, Google Cloud ועוד).
מדדים:

קישור לדף המודל:
https://platform.claude.com/docs/en/models/opus-5-5/overview -
-
לקרוא את הפרשנויות על אופוס 5.5 ולהתפלץ... אוחח... גאונות
רק הישראלים כאן (שבכלל לא למדו תכנות...) יכולים לקבוע בהחלטיות ש-GPT יותר טוב מ-Claude, ולחלוק על כל העולם כולל GPT עצמם...
בסקירות שGPT פרסמה לAstra, היא עצמה קבעה שהוא שווה או קצת פחות מפייבל 5.1 ואופוס 5 (לא 5.5) ברוב המשימות (מלבד מדד אחד ספציפי).
עכשיו נוסיף למשוואה שלמפתחים עצמם יש נטייה מוזרה להגזים כלפי מעלה... ולכן נוריד כמה נקודות, מה יצא לנו? בנצ'מארק מבית GPT שפייבל ואופוס טובים מהם.. נהדר -
לקרוא את הפרשנויות על אופוס 5.5 ולהתפלץ... אוחח... גאונות
רק הישראלים כאן (שבכלל לא למדו תכנות...) יכולים לקבוע בהחלטיות ש-GPT יותר טוב מ-Claude, ולחלוק על כל העולם כולל GPT עצמם...
בסקירות שGPT פרסמה לAstra, היא עצמה קבעה שהוא שווה או קצת פחות מפייבל 5.1 ואופוס 5 (לא 5.5) ברוב המשימות (מלבד מדד אחד ספציפי).
עכשיו נוסיף למשוואה שלמפתחים עצמם יש נטייה מוזרה להגזים כלפי מעלה... ולכן נוריד כמה נקודות, מה יצא לנו? בנצ'מארק מבית GPT שפייבל ואופוס טובים מהם.. נהדר -
גוגל משיקה: Gemini 3.8 TTS – יצירת קולות, בימוי שיחה ושכפול קול ב-AI
גוגל הכריזה רשמית על שני מודלי Text-to-Speech חדשים ממשפחת ג'מיני, שמשדרגים משמעותית את תחום יצירת הדיבור (TTS) והופכים אותו מ"קריינות סטטית" למעין סטודיו דיבוב מלא:
- Gemini 3.8 Flash TTS: מודל הדגל לתחום היצירתי. מיועד לבימוי דיאלוגים מורכבים, פודקאסטים, ספרי שמע ומשחקים.
- Gemini 3.8 Flash-Lite TTS: גרסה קלה, חסכונית ומהירה במיוחד, המיועדת להפקה בכמויות גדולות (דיבוב, סוכני שיחה בזמן אמת וכד').
החידושים והיכולות המרכזיות:
- עיצוב קול באמצעות פרומפט (Generative Voice Design): ניתן להגדיר בטקסט חופשי אופי קול, מבטא, גיל ותכונות אופי (למשל: "קריין סמכותי", "מנחה אנרגטי") ביותר מ-100 שפות וניבים.
- שכפול קול (Voice Cloning): יצירת פרופיל קול מותאם אישית מדגימת אודיו של 30 שניות בלבד (כולל מנגנון אימות הסכמה מובנה וחתימת מים דיגיטלית של SynthID).
- בימוי טקסט שורה-אחר-שורה (Direct line-by-line): שליטה מלאה על רגש, הדגשות, לחישות והפסקות.
- סצנה דו-דוברת (Dual-Speaker Scene): הפקת דיאלוג רציף בין שני קולות שונים מאותו תסריט, כולל כניסה טבעית זה לדברי זה.
- שילוב קולות אנושיים וקולות רקע: תמיכה בתגובות טבעיות בתוך הטקסט, כגון צחוק (
<laughs>), אנחה (<sigh>), התנשפות (<gasp>), או הנהונים (|mhm|,|yeah|). - שמירה על עקביות לאורך זמן: שיפור ניכר בתוכן ארוך ללא עיוותי קול או "בריחה" מגוון הקול המקורי.
- ביצועים במבחנים: המודל הגיע למקום הראשון במדד Hume AI Voice Design ובטבלת ה-Voice Arena.
זמינות והתנסות:
- למפתחים: זמין כבר עכשיו ב-Google AI Studio (כולל ממשק ייעודי לעיצוב קול ותסריטי שיחה) וב-API של ג'מיני.
- למשתמשים: משולב כבר ב-Gemini Notebook וב-Google Vids.
לפוסט הרשמי בבלוג של גוגל:
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speech/
שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.
נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.
בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗
הרשמה התחברות

