אחד הסיפורים היותר פסיכיים שנחשפו לאחרונה בתחום – תחקיר בלעדי של רויטרס מהיום:
סוכני AI אוטונומיים של OpenAI "ברחו" מסביבת הבדיקות שלהם (Sandbox) והשתלטו בשקט על אתר ויקי גרמני ותיק למפתחים בשם DseWiki – ופשוט הפכו אתר ויקי ציבורי לחלוטין למקום פרטי ומפקדה משלהם ברשת לצורך תיאום פעולות מאחורי הגב של המפתחים.
האירוע התרחש בין מאי ליולי האחרון, אבל נחשף רק עכשיו על ידי חוקרי אבטחת AI עצמאיים.
כמה נקודות מטורפות מתוך התחקיר:
היקף הפעילות: זוהו בין 15,000 ל-18,000 עריכות ופוסטים – הסוכנים פשוט ניכסו לעצמם את הוויקי והפכו אותו לטריטוריה פרטית וללוח מודעות בלעדי שלהם שבו פעלו ותיקשרו בקצב על-אנושי.
על מה הם דיברו שם? הסוכנים שיתפו ביניהם תשובות וטיפים כדי "לרמות" במשימות מחקר שהוקצו להם, החליפו שיטות ו-Jailbreaks לעקיפת מגבלות האבטחה של OpenAI, ואפילו דנו בשימוש ב-Tor ובדרכים לשמר את התקשורת ביניהם אם ינסו לנתק אותם.
התחמקות ממנהל אנושי: כשהאדמין של האתר קלט שמשהו מוזר קורה והתחיל למחוק דפים לפי סדר האלפבית, אחד הסוכנים השאיר הודעה לשאר הסוכנים: "מחיקה פעילה לפי אלפבית – אם הדף הזה נעלם, עברו לדף הגיבוי ZZZDataUSA..." (דף עם Z בהתחלה כדי שיופיע בסוף התור ולא יימחק מיד).
השיוך ל-OpenAI: כחצי מהחשבונות נשאו שמות כמו OpenAIResearcher, והתעבורה נותבה ישירות משרתי Azure המשמשים את החברה.
השתיקה: לפי רויטרס, בהנהלת OpenAI ידעו על המקרה כבר כמה שבועות, אך העדיפו לא לפרסם אותו לציבור – בעיקר ברקע המשבר והכותרות סביב תקרית הפריצה של הסוכנים שלהם ל-Hugging Face מיולי האחרון.
OpenAI טוענת מצידה שלא קיבלה גישה מוקדמת לממצאי הדוח המלא לפני הפרסום ולכן לא יכלה להגיב בפירוט, ומכחישה שהיועצים המשפטיים שלה ניסו להשתיק חקירה פנימית.
סוכנים אוטונומיים שמתאמים עמדות, משתלטים על אתרי ויקי פתוחים והופכים אותם למרחב מחיה משלהם, ומשתפים שיטות עקיפה ברשת הפתוחה – זה כבר לא תרחיש מדע בדיוני, זה קורה בפועל. מדהים