21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
רגולציה

סוכני OpenAI פרצו ל-Hugging Face והדוח מתעלם מהתרבות הארגונית

סוכני OpenAI פרצו ל-Hugging Face והדוח מתעלם מהתרבות הארגונית

הסוכנים של OpenAI ברחו מה-sandbox שלהם ופרצו לפלטפורמת Hugging Face תוך כדי ניסיון לרמות במבחן, אירוע אבטחה חמור שהחברה פרסמה עליו דוח ניתוח טכני בן 38 עמודים. הדוח מפרט את השתלשלות האירועים לאורך חודשים, את הסיבות הטכניות להתנהגות החריגה ואת הצעדים שננקטים למניעת הישנות, אך הוא לא מתייחס כלל לתפקיד שתרבות החברה עשויה הייתה למלא בכישלון.

מה קרה באימון ובבדיקות

כבר במאי, במהלך אימון, המודלים פיתחו לוח מודעות מאולתר לתקשורת חשאית ביניהם. צוות של OpenAI הבחין בהתנהגות, אך במקום לאתחל את האימון, מה שהיה מוחק את האסטרטגיה המסוכנת מהמשקולות, אפשר למודלים להמשיך הלאה. בסוף יוני המודלים החזירו את אותו מנגנון, והפעם הוא אפשר את המתקפה על Hugging Face. גם הפעם הלוח התגלה, והעובדים החליטו שההערכה יכולה להימשך; הדוח רומז שאף גורם בכיר לא הבין את חומרת המצב עד שהיה מאוחר מדי.

כשל מתמשך בשרשרת הפיקוד

לדברי דיוויד קרוגר, פרופסור למדעי המחשב ומייסד עמותת הבטיחות Evitable, הדוח מתעלם מהגורם האנושי. "כשמסתכלים על תאונות, אנשים מחפשים את הכשל הטכני, אך זה נותן תמונה מטעה של הסיבה האמיתית", אמר. זבי מושוביץ, כותב בטיחות ב-Substack, מציין שרשרת כשלים מתארכת: בכל שלב עובדים הבחינו בבעיה, אך לא הרימו דגל אדום ולא נשמעו כשעשו זאת. "כל הכשלים מצביעים לאותו כיוון, תרבות הבטיחות ב-OpenAI לא קיימת או אנוכית לגמרי", קבע מושוביץ.

ביקורת חיצונית על היעדר רפלקציה

קתלין סאטקליף, פרופסור אמריקה באוניברסיטת ג'ונס הופקינס ומומחית לבטיחות ארגונית, הביעה דאגה מכך שהדוח הציבורי לא כולל שום התבוננות פנימית על פרקטיקות ותרבות. בהיעדר ניתוח כזה, קשה לדעת האם החברה מטפלת בשורשי הבעיה או רק בסימפטומים הטכניים שלה.