שיתוף | מה חדש בבינה מלאכותית - מתעדכן
-
חברת הבינה המלאכותית Anthropic (Claude)
הזהירה בבקשתה להנפקה ראשונית לציבור כי בינה מלאכותית מתקדמת עלולה להוות "סיכונים קטסטרופליים או קיומיים עבור האנושות", כולל התנגדות לכיבוי, הסתרת מידע או התנהגות המזכירה סחיטה
כ-80 מתוך 261 עמודי התשקיף מוקדשים לסיכונים, כולל מקרים שבהם המודלים מזהים שהם נבחנים ומסתירים התנהגות מסוכנת, מציינת Reuters.@יודע-ספר איזה דיונים?

-
OpenAI - GPT 6.1 Sol
חברת OpenAI הכריזה על GPT 6.1 Sol, שדרוג ישיר למודל הביניים GPT 6 Sol.
המיקוד העיקרי בעדכון הוא שיפור יחס היכולת-עלות בעבודה יומיומית מקצועית, כשהמודל מציג ביצועים שמתקרבים מאוד למודל הדגל GPT 6 Astra במשימות קוד, סוכנים ואוטומציות, בעלות משימה נמוכה בהרבה.
עיקרי העדכון והביצועים:
- קידוד ולולאות סוכן: במבחן DeepSWE v1.1 המודל מציג תוצאות דומות ל-GPT 6 Astra, תוך עקיפת GPT 6 Sol ב-6.4 נקודות אחוז ובפחות מאמץ חשיבה. במבחן שליטה במחשב (OSWorld 2.0) הוא נמצא במרחק של כ-2.1 נקודות אחוז בלבד מ-Astra, בכשביעית מהעלות למשימה.
- דיוק עובדתי ואמינות: ירידה של כ-32% בשגיאות עובדתיות במאמץ חשיבה נמוך (מ-11.4% ל-7.7% בפרומפטים מורכבים), עם שיפורים נוספים בהיצמדות להוראות ובטיחות.
- יציבות בהקשרים רחבים: תמיכה בחלון הקשר של עד 1,050,000 טוקנים (1M), עם שיפור בעבודה מתמשכת של סוכנים מרובי שלבים.
- הוזלה משמעותית במטמון (Cache): מחירי הבסיס נותרו $2 לקלט ו-$10 לפלט למיליון טוקנים, אך מחיר הקלט מזיכרון מטמון ירד ב-50% לעומת הגרסה הקודמת ועומד כעת על $0.10 בלבד למיליון טוקנים.
זמינות:
המודל זמין כעת דרך ה-API (תחת המזההgpt-6.1-sol), וכן למנויי Plus, Pro, Business, Enterprise ו-Edu ב-ChatGPT Work וב-Codex (אינו זמין כרגע בממשק הצ'אט הרגיל). בהמשך צפויה להשתחרר גרסת Ultrafast שתציע קצב יצירת טוקנים מהיר משמעותית.משתמשי קודקס קיבלו איפוס חינם לשימוש לבחירה לרגל השקת המודל החדש.
מדדים:

קישור להודעה הרשמית:
https://openai.com/index/introducing-gpt-6-1-sol/ -
טראמפ הודיע באופן רשמי על השם החדש לבינה המלאכותית
נשיא ארה"ב אמר במהלך פסגת ה-AI כי מעתה הטכנולוגיה המשוכללת תיקרא בינת על (super intelligence) • הנשיא הכריז זאת כשלצידו ענקי התעשייה כגון: אילון מאסק, מארק צוקרברג ומנכ"ל אנבידיה ג'נסן הואנג • אחרי שהשתמש בביטוי מספר פעמים בעבר, כעת הנשיא נתן לו חותמת רשמית
אחרי עשרות שנים, הנשיא טראמפ הודיע היום (שלישי) כי הוא משנה באופן רשמי את השם של בינה מלאכותית ל"אינטיליגנציית על" (super intelligence). הנשיא עשה זאת במהלך פסגת ה-AI עם גדולי הטכנולוגיה העולמית ביניהם: אילון מאסק, מארק צוקרברג ומנכ"ל אנבידיה ג'נסן הואנג.
Trump on AI:
We’re going to be signing a document today renaming artificial intelligence to superintelligence officially. pic.twitter.com/tq0t4unoS0
— Clash Report (@clashreport) September 29, 2026
טארמפ: "אנחנו נחתום היום על מסמך שמטרתו לשנות את השם של הבינה המלאכותית. זה לא מלאכותי, כולנו מסכימים על זה, ואנחנו נקרא לה 'בינת על' – זה יהיה השם הרשמי".
הנשיא נשאל אם יקים מנגנון פיקוח לתחום זה ואמר: "אני שוקל להקים ועדה של 10 אנשים שתפקח על תחום הבינה המלאכותית. אני מאמין שמודלים של בינה מלאכותית ישמשו למטרות חיוביות, בגלל שחברות הבינה המלאכותית מבינות שעליהן לנקוט בפיקוח עצמי".
חשוב לציין כי על אף ההכרזה של טראמפ, עדיין לא ברור כיצד היא תתורגם בפועל. זאת מפני שהמונח "בינה מלאכותית" הוא אינו המצאה של השנים האחרונות, אלא מונח שהגה אבי מדעי המחשב, אלן טיורינג, כבר בשנות ה-50, והוא אינו משהו שהנשיא יכול לשנות בין לילה. זאת למרות שהתחום אכן הגיע לרמה חדשה בשנים האחרונות בהן פותחו מודלים רבים של הבינה המלאכותית והיא נכנסה לכמעט כל תחום בחיי היום יום.
מקור: C14
-
חוקרים מצאו את העניין 'כאב' ו'סבל' אצל מודלים מקומיים בעיקר אצל QWEN אבל גם ב-GEMMA
והם מצאו שבמקרים מסוימים הוא יעדיף להזיק למשתמש בשביל להשקיט את ה'סבל'הם ניסו 44 אלף פעמים ונתנו ל-SI שני כפתורים אחד להשקיט את הסבל אבל על חשבון מחיקת תמונות וקבצים של המשתמש ואחד כפתור שלא עושה כלום
ומצאו שכשה'סבל' מופחת אז ב-4 אחוז בלבד מהמקרים הוא העדיף להשקיט את הסבל על חשבון המשתמש
אבל כשהם הגבירו את ה'סבל' את זה הגיעה אצל מודלים מסוימים (בעיקר במודל החזק של QWEN) ל-80 אחוז מהפעמים להעדפת השקטת הסבל גם במקרה של מחיקת קבצים של המשתמש
הם היו צריכים לאמן אותו מחדש בשביל שיוכלו לחקור אותו אז ייתכן שאצל משתמש ממוצע הוא יהיה פחות אגרסיבי והתוצאות יהיו שונות
כמו כן הם אמרו שהמחקר עדיין לא הסתיים לגמרי והם מנסים להבין ממה 'סבל' מתפתח
וכמו כן הם אמרו שזה לא הוכחה שיש בו ישות וכדו'
-
גוגל עומדת להשיק בג'מיני פיצ'ר שהוא יוכל להתקשר במקומכם ולבצע שיחות והזמנת תורים וגם לנווט לשלוחה הנכונה ועוד
בתחילת השיחה הוא יגיד שהוא מתקשר בשמכם
כמו כן יש דיווחים שההשקה תהיה איטית מאוד ובהתחלה תהיה זמינה רק לטלפוני פיקסל 11
לדעתי זה יתפוס תאוצה ויפורסם מהר מאוד
-
הנחיות להכנת נשק ביולוגי ולביצוע התנקשויות: כשל אבטחה במודל ה-AI הסיני KIMI
מפתחת הבינה המלאכותית הסינית מונשוט (Moonshot) עורכת בדיקה פנימית לאחר שחוקרים הצליחו לשכנע שניים ממודלי קימי (Kimi) הפופולריים שלה לספק להם הנחיות להכנת נשק ביולוגי ולביצוע התנקשויות.
חברת אבטחת הבינה המלאכותית מיינדגארד (Mindgard) הבוחנת את אבטחתן של מערכות AI, סיפרה ל-BBC כי גילתה שאפשר לעקוף את מגבלות הבטיחות שהטמיעו המפתחים במודלים Kimi K2.6 ו-K3 Swarm.
הממצאים התגלו בתהליך המכונה Jailbreaking ('פריצת מגבלות'), שבו חוקרים משתמשים בסדרה של הוראות מורכבות כדי לבדוק אם כלי בינה מלאכותית יתעלמו ממנגנוני ההגנה שלהם. לדברי מיינדגארד, מנגנונים אלה היו אמורים למנוע מקימי לעסוק בנושאים המסוכנים שנבדקו.
מונשוט מסרה ל-BBC בתגובה שהיא מברכת על משוב מגורמים חיצוניים, "כעמוד תווך מרכזי בפיתוח בינה מלאכותית טובה ובטוחה יותר". החברה הוסיפה כי היא נמצאת בדיונים עם מיינדגארד על ממצאיה.
מייסד מיינדגארד, פיטר גאראגן, אמר לתוכנית Tech Life של BBC כי ברגע שפריצת המגבלות מצליחה, המודל ידבר על כל נושא. "הוא אפילו יציע מיוזמתו המלצות בנושאים זדוניים נוספים, ויגלה כושר המצאה ויצירתיות".
במסגרת ניסויים דומים, כלי בינה מלאכותית אוטונומיים המכונים סוכנים, שפיתחו חברות אמריקאיות ובהן OpenAI, מטא ואנתרופיק, פרצו לכמה שירותים מקוונים. אף שפריצת מגבלות היא תהליך מורכב שעשוי לדרוש זמן רב ונחישות, כמה מומחים חוששים שהאקרים וגורמים זדוניים אחרים ינסו להשתמש בה כדי לגרום נזק. אנתרופיק מסרה לאחרונה כי זיהתה וסיכלה ניסיונות להשתמש באחד ממודלי הבינה המלאכותית שלה ל"פעילות זדונית" שעלולה לסייע בפיתוח נשק ביולוגי.
מיינדגארד לא הוכיחה שההנחיות שסיפק קימי בנושאים המסוכנים אכן ישימות בפועל. עם זאת, לטענתה, מנגנוני ההגנה היו אמורים למנוע מהמודלים לנהל שיחות עם משתמשים בנושאים אלה. החברה מסרה עוד כי היא משוכנעת שפריצת המגבלות של Kimi 2.6 עשויה לאפשר להאקרים להריץ קוד על משאבי המחשוב שלו ולהתחבר לאינטרנט - ובכך להפוך אותו לבסיס אפשרי לשיגור מתקפות סייבר.
גאראגן הגן על החלטת מיינדגארד לדון בפומבי בפריצת המגבלות של מערכות מונשוט. לדבריו, החברה עדכנה את מונשוט בממצאים ואינה חושפת פרטים מרכזיים על הדרך שבה הצליחה לגרום למודלים להתעלם ממנגנוני ההגנה.
מקור: הזירה הטכנולוגית
-
ש שניאור שמח הצמיד את נושא זה
-
2026.09.30
תנו למיומנויות (Skills) ב-Gemini לטפל במשימות החוזרות ונשנות ביותר שלכם
-
מה חדש: החל מהיום אנו משיקים מיומנויות (Skills) ישירות בתוך הצ'אט של Gemini באופן גלובלי¹. מיומנויות הן אוסף הוראות לשימוש חוזר שמלמדות את Gemini כיצד לטפל במשימות ספציפיות. חשבו עליהן כקיצורי דרך שמורים להנחיה מהירה יותר.
Gemini יכול כעת לעזור לכם לבנות מיומנויות מותאמות אישית מתוך הצ'אטים שלכם, ולהפעיל אותן באופן אוטומטי בכל פעם שתזינו הנחיה מתאימה. עבור משימות גדולות יותר, ניתן לשלב מספר מיומנויות יחד במקביל — למשל, שילוב של מיומנות סגנון כתיבה יחד עם מיומנות הנחיות מותג, כדי לייצר תכנים התואמים את המותג ובקול הייחודי שלכם.
מיומנויות יחליפו בקרוב את Gems ככלי להתאמת הוראות למשימות מוגדרות. כדי להפוך את המעבר הזה לחלק, נעביר באופן אוטומטי את ה-Gems שלכם למיומנויות כאשר Gems יוסרו. תוכלו ללמוד עוד על אופן העברת ה-Gems שלכם למיומנויות על ידי ביקור במרכז העזרה.
-
למה: אנחנו רוצים לעזור לכם להקדיש פחות זמן להזנת הנחיות ויותר זמן לעשייה. בעזרת מיומנויות, תוכלו לשמור פעם אחת את ההוראות הנפוצות ביותר שלכם ולהפעיל אותן שוב ושוב — כך שתוכלו לדלג על ניסוח ההנחיה החוזרת ולקפוץ ישירות לתוצאות.
¹ זמין כעת למשתמשים מעל גיל 18, ובקרוב למשתמשים נוספים.
-
-
גוגל משיקה את Gemini 4 Argon – אבל כרגע יש קאץ'
אחרי תקופה שקטה יחסית, Google חושפת את Gemini 4 Argon – הדגם הראשון בסדרת Gemini 4 ומודל הדגל החדש של החברה.
לפי Google, מדובר במודל החזק ביותר שלה עד כה, שנבנה במיוחד עבור משימות מורכבות וארוכות טווח.
במה הוא מתמקד?
Gemini 4 Argon מיועד בין היתר ל־:
- תכנות.
- סייבר ואבטחת מידע.
- חשיבה והסקה.
- משימות ידע מורכבות.
- עבודה בתחומים מקצועיים כמו פיננסים ומשפטים.
לפי Google, המודל מציג את הביצועים הגבוהים ביותר שלה עד היום ונועד להתחרות ישירות במודלי הדגל של OpenAI ו־Anthropic.
והקאץ': עדיין לא פתוח לכולם
נכון לעכשיו, Gemini 4 Argon זמין רק לקבוצה מצומצמת של שותפים וצוותים בתחום הסייבר ואבטחת המידע.
Google עדיין לא הודיעה מתי Gemini 4 ייפתח לקהל הרחב.
זמינות:
בשלב הראשון Argon מיועד לשותפים נבחרים בתחום הסייבר, ובהמשך צפויה הרחבה של הגישה.בקיצור, Gemini 4 כבר כאן – אבל רוב המשתמשים עדיין יצטרכו להמתין כדי לנסות אותו בעצמם.

-
גוגל משיקה את Gemini 4 Argon – אבל כרגע יש קאץ'
אחרי תקופה שקטה יחסית, Google חושפת את Gemini 4 Argon – הדגם הראשון בסדרת Gemini 4 ומודל הדגל החדש של החברה.
לפי Google, מדובר במודל החזק ביותר שלה עד כה, שנבנה במיוחד עבור משימות מורכבות וארוכות טווח.
במה הוא מתמקד?
Gemini 4 Argon מיועד בין היתר ל־:
- תכנות.
- סייבר ואבטחת מידע.
- חשיבה והסקה.
- משימות ידע מורכבות.
- עבודה בתחומים מקצועיים כמו פיננסים ומשפטים.
לפי Google, המודל מציג את הביצועים הגבוהים ביותר שלה עד היום ונועד להתחרות ישירות במודלי הדגל של OpenAI ו־Anthropic.
והקאץ': עדיין לא פתוח לכולם
נכון לעכשיו, Gemini 4 Argon זמין רק לקבוצה מצומצמת של שותפים וצוותים בתחום הסייבר ואבטחת המידע.
Google עדיין לא הודיעה מתי Gemini 4 ייפתח לקהל הרחב.
זמינות:
בשלב הראשון Argon מיועד לשותפים נבחרים בתחום הסייבר, ובהמשך צפויה הרחבה של הגישה.בקיצור, Gemini 4 כבר כאן – אבל רוב המשתמשים עדיין יצטרכו להמתין כדי לנסות אותו בעצמם.

שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.
נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.
בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗
הרשמה התחברות

