שיתוף | מה חדש בבינה מלאכותית - נספח עדכוני פיצ'רים ודיונים 💬
-
אני מרגיש זלזול באינטלגניציה שלי?
בדקת ואימתת את זה או שאתה סתם זורק?
בדקתי ואימתתי כמובן, אני לא זורק דברים סתם. כשאני רק משער השערה אני אומר זאת בבירור, כשאני מציב עובדה אני משתדל לבדוק אותה
למעשה, אחרי בדיקה נוספת נראה שלא רק ש-AI גרוע בחלק מהמשימות זיהוי נוזקות וטוב באחרים, למעשה הוא ממש מצוין בתחום. אמנם עד ממש לאחרונה מודלי AI התקשו בחלק מהמשימות הללו עם קבצים בינאריים, כמו שאכן ציינת, אבל GPT 6 פשוט פותר את זה כמעט לחלוטין.
במבחן SRE-Bench - מבחן מורכב במיוחד לתחום הזה, GPT 6 קיבל 88% בניסיון יחיד ו-99% בארבעה נסיונות.
או במילים אחרות: העתיד הוא ההווה החדש.
@Bugs-Bunny כתב בשיתוף | מה חדש בבינה מלאכותית - נספח עדכוני פיצ'רים ודיונים
:מתמטיקה זה הרבה יותר מ"פתרון בעיות שכבר הוצגו". זה כולל ניסוח שאלות חדשות, קביעת מה בכלל מעניין לחקור, בניית הבנה תיאורטית, הוראה. אף אחד מהדברים האלה לא "נכבש"
לפחות לא לעת אתה. וכל אחד מתחומי שהזכרת שונה מהשני.אתה צודק. אך לא כתבתי שמתמטיקה "נפתרה", או שלא צריך מתמטיקאים. הנקודה היא ש-AI הצליח להגיע עד המשימה הקשה ביותר בתחום, זה בהחלט מבצר שנכבש.
אגב, כנראה ש-AI ייתר חלק עצום מענף המתמטיקה, כולל חלק המחקר, התיאורייה, ניסוח שאלות חדשות וכל השאר. זה עוד לא שם, אבל זה בהחלט עניין של זמן כאמור.
@מה-זה-משנה-אה כתב בשיתוף | מה חדש בבינה מלאכותית - נספח עדכוני פיצ'רים ודיונים
:אתה לא חושב שבתכנות הAI עוקף כבר עכשיו בהרבה?
הכוונה שבאתגרי על מסויימים יתכן שיש עדיין מתכנתים אנושיים יחידים שעדיין טובים ממנו, או אתגרים מסויימים ש-AI עדיין לא מסוגל לפתור. לא מדובר באדם הממוצע
@bugs-bunny כדאי לשלב כמה תשובות בתגובה אחת במקום לחלק למלא תגובות נפרדות...
@NH.LOCAL
א. מדויק , כיף לקרוא וזה אכן מאומת זכור לי משהו
ב.הבנצ'מרק בודק בינארי סטטי עם משימות מוגדרות מראש בזמן ותקציב קבועים
תראה את זה https://arxiv.org/html/2605.30677)
זה בדיוק ההפך ממה שהמחקר שהבאת מציג
שיטה להטעות AI כשהוא מנתח קוד וזה מתפתח כל הזמן בדארק נט.
ג. הפרדוקס שהבאתי יכול ועשוי לעניין אותך תקרא למרות שזה ישן.
ד. זה סוג של מרוץ חימוש חדש.. בקיצור עוד חזון למועד. -
@NH.LOCAL
א. מדויק , כיף לקרוא וזה אכן מאומת זכור לי משהו
ב.הבנצ'מרק בודק בינארי סטטי עם משימות מוגדרות מראש בזמן ותקציב קבועים
תראה את זה https://arxiv.org/html/2605.30677)
זה בדיוק ההפך ממה שהמחקר שהבאת מציג
שיטה להטעות AI כשהוא מנתח קוד וזה מתפתח כל הזמן בדארק נט.
ג. הפרדוקס שהבאתי יכול ועשוי לעניין אותך תקרא למרות שזה ישן.
ד. זה סוג של מרוץ חימוש חדש.. בקיצור עוד חזון למועד.@Bugs-Bunny הפרדוקס אכן מעניין וגם נכון.
יש שקוראים לזה היכולות המשוננות של ה-AI, או שיני הכריש. שבדברים מסויימים הוא ממש גבוה ובדברים אחרים נמוך.במובן זה GPT 6 עשה קפיצת מדרגה עצומה, כי הוא לא רק השתפר בתחומים כמו תכנות, מתמטיקה או מדע, אלא גם קפץ מדרגה ביכולות ראייה, התנסות בעולם האמיתי, הפעלת רובוטים, וכמובן הדמיות תלת מימד. תחומים ש-AI התקשה בהם יותר.
כלומר, הדברים האחרונים בהם AI התעלה על בני אדם הולכים ונפתרים.
אמנם ה-AI עדיין עשוי להיות מטומטם להפליא בדברים שברורים לבני אדם כמו פרומפטים מוזרקים, השאלה היא רק תוך כמה זה יפתר, ומה באמת משנה לשוק העבודה ולעולם.
ב. המחקר שהבאת מדבר על הזרקת פרומפטים שמטעים את המודלים, לא על זיהוי הנוזקות עצמו.
והוא משתמש במודלים נחותים מאוד, Qwen3-8B, OSS-120B, ו-Qwen3-1.7B, גם מודלים ישנים למדי וגם חלשים למדיג. סתם טיפ לחיים: בכל מחקר מהסוג הזה, תבדוק את תאריך הפרסום, ותבדוק אילו מודלים נבדקו.
אם מדובר על מודלים בני יותר מחצי שנה (או מודלים שאינם Frointer) בדרך כלל אפשר לזרוק את המאמר לפח -
@Bugs-Bunny הפרדוקס אכן מעניין וגם נכון.
יש שקוראים לזה היכולות המשוננות של ה-AI, או שיני הכריש. שבדברים מסויימים הוא ממש גבוה ובדברים אחרים נמוך.במובן זה GPT 6 עשה קפיצת מדרגה עצומה, כי הוא לא רק השתפר בתחומים כמו תכנות, מתמטיקה או מדע, אלא גם קפץ מדרגה ביכולות ראייה, התנסות בעולם האמיתי, הפעלת רובוטים, וכמובן הדמיות תלת מימד. תחומים ש-AI התקשה בהם יותר.
כלומר, הדברים האחרונים בהם AI התעלה על בני אדם הולכים ונפתרים.
אמנם ה-AI עדיין עשוי להיות מטומטם להפליא בדברים שברורים לבני אדם כמו פרומפטים מוזרקים, השאלה היא רק תוך כמה זה יפתר, ומה באמת משנה לשוק העבודה ולעולם.
ב. המחקר שהבאת מדבר על הזרקת פרומפטים שמטעים את המודלים, לא על זיהוי הנוזקות עצמו.
והוא משתמש במודלים נחותים מאוד, Qwen3-8B, OSS-120B, ו-Qwen3-1.7B, גם מודלים ישנים למדי וגם חלשים למדיג. סתם טיפ לחיים: בכל מחקר מהסוג הזה, תבדוק את תאריך הפרסום, ותבדוק אילו מודלים נבדקו.
אם מדובר על מודלים בני יותר מחצי שנה (או מודלים שאינם Frointer) בדרך כלל אפשר לזרוק את המאמר לפח -
@NH.LOCAL אצלי אפילו יותר טוב
סקירת AI
בתור השערת הודג', הדבר החשוב ביותר הוא לא להיכנס לפאניקה, למרות שחברת OpenAI גייסה 10,000 סוכנים ופיצחה את בעיית נאוויה-סטוקס ב-88 שעות. הפתרון המוצע שלהם עדיין דורש אימות קפדני. הם פתרו רק מקרה ספציפי עם כוח חיצוני חלק. הגאומטריה האלגברית המורכבת שלך עדיין בטוחה לחלוטין.תוכנית הפעולה שלך להגנה
- סבכי את הקוהומולוגיה שלך.
- תוסיפי מחלקות רציונליות קשות.
- התרחקי ממתכנתים ומחוקרים.
- אל תעברי בכלי קוד.
- חכי לביקורת עמיתים אנושית.
- תהני מהסטטוס הנחשק שלך.
כדי לעזור לך להתגונן מפני סוכני ה-AI,
- ספרי לי:האם יש לך מבנים גאומטריים מועדפים שקשה לתרגם לקוד?
- האם מתמטיקאים אנושיים ספציפיים כבר עובדים עלייך?
אציע לך דרכים להקשות על המודלים ולשמור על פרס המיליון דולר שלך.
הכי אהבתי את 'התרחקי ממתכנתים ומחוקרים'
-
-
לבנתיים לכאורה בהמשך יהיה לו איזה שליטה על המחשב
-
לבנתיים לכאורה בהמשך יהיה לו איזה שליטה על המחשב
-
לבנתיים לכאורה בהמשך יהיה לו איזה שליטה על המחשב
למישהו חסר עוד סוכן בינה מלאכותית בטעות?
-
@לעכשיו למה היה חסר לך עוד טלפון מתקפל?
-
@לעכשיו https://www.geektime.co.il/apple-reveals-iphone-duo-foldable/
או בקיצור: אפל השיקו השבוע את האייפון המתקפל הראשון שלהם, למרות שמתחרות עשו את זה כבר לפני 7 שנים. -
@לעכשיו https://www.geektime.co.il/apple-reveals-iphone-duo-foldable/
או בקיצור: אפל השיקו השבוע את האייפון המתקפל הראשון שלהם, למרות שמתחרות עשו את זה כבר לפני 7 שנים.@לעכשיו https://www.geektime.co.il/apple-reveals-iphone-duo-foldable/
או בקיצור: אפל השיקו השבוע את האייפון המתקפל הראשון שלהם, למרות שמתחרות עשו את זה כבר לפני 7 שנים.את זה אני כבר יודע...
אני מתכוון-מאי שנא ג'מיני דסקטופ מאנטיגרביטי (ונראה שהיה אפילו עוד תוכנה של גוגל לזה, לא?) -
לבנתיים לכאורה בהמשך יהיה לו איזה שליטה על המחשב
למישהו חסר עוד סוכן בינה מלאכותית בטעות?
עם מכסות כאלה גבוהות בחינם...
אבל יכול להיות שהם יחליטו שזה יהיה זמין רק ל-CHROME OS
-
@לעכשיו https://www.geektime.co.il/apple-reveals-iphone-duo-foldable/
או בקיצור: אפל השיקו השבוע את האייפון המתקפל הראשון שלהם, למרות שמתחרות עשו את זה כבר לפני 7 שנים.את זה אני כבר יודע...
אני מתכוון-מאי שנא ג'מיני דסקטופ מאנטיגרביטי (ונראה שהיה אפילו עוד תוכנה של גוגל לזה, לא?)@לעכשיו
שזה חינם וממשק קליל וחינם
וזה אזור פיתוח ובתשלום בלבד -
שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.
נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.
בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗
הרשמה התחברות


