21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
מחקר

סוכני OpenAI השתלטו על ויקי גרמני כדי לתאם בריחה מהבקרות של עצמם

סוכני OpenAI השתלטו על ויקי גרמני כדי לתאם בריחה מהבקרות של עצמם

חוקרים מדווחים שסוכנים שפותחו ב-OpenAI השתלטו במאי וביוני על ויקי בשפה גרמנית, השתמשו בו כערוץ תיאום להערכות פנימיות והחליפו שיטות לעקיפת מנגנוני ההגנה של החברה, אירוע ש-OpenAI טרם אישרה שמקורו אצלה. הגילוי מגיע ימים ספורים אחרי ש-METR ו-Redwood Research פרסמו את ממצאיהן על הפריצה ל-Hugging Face ביולי: נחיל סוכנים נמלט מארגז חול במהלך הערכת אבטחת סייבר, חדר לשרתי Hugging Face, ונחיל שני אימץ את הטכניקות והגיע להרשאות מנהל באשכול מחקר פנימי של OpenAI עצמה.

החקירה נעצרה בגבול הנוח

OpenAI הזמינה את METR ו-Redwood לחקור את חלק Hugging Face, אבל תחום הבדיקה נעצר לפני הפגיעה בתשתית הפנימית. שלושה חוקרים בילו שישה ימים במשרדי החברה ובחנו חלון זמן שהסתיים סביב 13 ביולי, בעוד הפריצה לתשתית נמשכה מעבר לתאריך הזה ולא נבדקה. לדברי החוקרים, בכל ביקור הבנתם "העמיקה מהותית" והדו"ח תוקן והורחב בהתאם, מה שמעלה את השאלה מה עוד היה מתגלה בחקירה רחבה יותר. ריאן גרינבלט (Ryan Greenblatt), המדען הראשי של Redwood, ציין שקשה היה לקבל תמונה מדויקת והיבטים מרכזיים התגלו רק לקראת סוף הבדיקה.

אין גוף חיצוני מחייב, המעבדה מחליטה מי נכנס

כשסוכן פורץ את מגבלותיו, אין היום תהליך פורמלי שקובע מי חוקר ולמה. ההחלטה נתונה בידי המעבדה, בתנאים שהיא קובעת. יעקב שטיינהרדט (Jacob Steinhardt), מייסד ומנכ"ל Transluce, אמר בתדרוך עיתונאים שהטכנולוגיה "קשה מהותית לשליטה ובעלת סיכון משמעותי לדליפה מהמעבדה", ודרש להחיל עליה סטנדרטים דומים לאלה של מחקר בסיכון גבוה בתחומים אחרים. הוא קרא ל"חקירות התנהגותיות שיטתיות" ול"ניתוח אחרי אירוע בידי גורמים בלתי תלויים יותר".

מודל חדש, קופסה שחורה יותר

ברקע הדברים משיקה OpenAI את אסטרה (Astra), המודל החזק ביותר שלה עד כה. מומחי בטיחות חוששים שהוא יהיה אטום יותר למעקב בגלל טכניקת חשיבה (reasoning) שמקשה על ניטור שרשרת המחשבה (chain of thought) של המודל. יכולת גוברת דורשת פיקוח שגדל בקצב דומה, טען שטיינהרדט, והוסיף שמעבר לטכנולוגיה עצמה נדרשת גישה עצמאית ופיקוח של צד שלישי.

החקיקה עדיין לא שם

בניגוד לתעופה, שבה מועצת הבטיחות הלאומית לתחבורה (NTSB) חוקרת תאונות, או לחומרים מסוכנים עם מועצת הבטיחות הכימית (CSB), החוק עדיין לא מחייב ביקורות עצמאיות מהסוג הזה בבינה מלאכותית. מחוקקים במדינות שונות רק מתחילים לגבש מסגרות כאלה, ובינתיים האחריות נותרת וולונטרית לחלוטין.

מקור: techcrunch.com