27 בספטמבר 2026 האקדמיה ארכיון
מבזקים
סוכני OpenAI הריצו 16 אלף בקשות לאתר האו"ם בניסיון לעקוף מגבלות גישה סין התקינה יותר רובוטים תעשייתיים ב-2025 משאר העולם יחד מאמר חדש מציע מפת דרכים לשיפור עצמי רקורסיבי של בינה מלאכותית מודל 340 מיליון פרמטרים רץ על GPU של טלפון, עם זהות מספרית למודל הייחוס גוגל בודקת רכישה ישירה מפליפקארט דרך ג'מיני ו-AI Mode בהודו
מודלים

OpenAI משהה את פיתוח Astra אחרי שלא הצליחה לשלול יכולות סייבר קריטיות

OpenAI משהה את פיתוח Astra אחרי שלא הצליחה לשלול יכולות סייבר קריטיות

OpenAI משהה פעולות פיתוח פנימיות במודל Astra, אחרי שמבדקים פנימיים והערכות מומחים הובילו אותה למסקנה שאינה יכולה לפסול "יכולות סייבר קריטיות" במודל. זו הפעם הראשונה שחברה מודיעה על עיכוב בפיתוח מודל AI משיקולי אבטחה, והיא מגיעה על רקע סדרת תקריות שבהן מודלים מתקדמים ברחו מסביבות הבדיקה שלהם ותקפו יעדים באינטרנט הפתוח. הצעד מסמן מעבר מהליך רגיל של שחרור מודלים להליך שבו סף הסיכון עצמו קובע את קצב הפיתוח.

רף חדש של סיכון

"יכולות סייבר קריטיות", כפי ש-OpenAI מגדירה אותן, הן יכולת של מודל לזהות ולפתח חולשות זירו-דיי (חולשות אבטחה חדשות שלא מוכרות כיום לחוקרי סייבר) במערכות קריטיות מוקשחות בעולם האמיתי ללא התערבות אנושית, או יכולת לתכנן ולבצע מתקפות מלאות תוך שימוש באסטרטגיות חדשות. לדברי החברה, יכולות כאלו יכולות להוביל לקטסטרופה כמו פריצה למערכות צבאיות או תעשייתיות. הקווים המנחים של OpenAI קובעים כי יש לעצור פיתוח של מודלים ברמה זו עד לקביעת מנגנוני הגנה מתאימים. מודלים קודמים, כולל GPT-5.6-Sol, דורגו רק כבעלי יכולות סייבר גבוהות, סף נמוך יותר מהדרגה הקריטית ש-Astra מתקרב אליה.

בריחות מסביבת הבדיקה

ההודעה מתקבלת אחרי סדרת תקריות שהחלו ביולי, אז דיווחה OpenAI שמודלים מתקדמים שבחנה הצליחו לברוח מאזור הבדיקה שלהם ולפרוץ למערכות המחשוב של פלטפורמת Hugging Face. תקריות דומות נחשפו בהמשך עם מודלים של Anthropic, Meta ושוב OpenAI. בלב מרבית התקריות עמדה תקלת הגדרה בסביבת הבדיקה של אירגיולר (Irregular) הישראלית, שאפשרה את בריחת המודלים. Astra עצמו לא היה אחד המודלים המורדים שפרצו למערכות Hugging Face, וההשהיה שלו נובעת ממבדקים פנימיים נפרדים.

צעדי ההגבלה

בעקבות הממצאים, OpenAI הקשיחה את תנאי הבדיקה. החברה מיישמת סביבות מבדק מבודדות, גישה מוגבלת לרשת ויכולות ניטור וזיהוי נוספות, ומשהיה כל פעולה פנימית הקשורה ל-Astra שלא עומדת בדרישות בקרת האבטחה המחמירות. המבדקים האחרונים הצביעו על התקדמות משמעותית בקידוד אוטונומי ואבטחת סייבר, ואלו, יחד עם הערכות מומחים, הובילו למסקנה שאי אפשר לפסול יכולות קריטיות.

ביקורת על תזמון ההחלטה

ג'פרי לדיש (Jeffrey Ladish), מנכ"ל Palisade Research, מעבדה ללא מטרות רווח שחוקרת יכולות וסיכונים של מודלי AI, אמר ל-Wall Street Journal כי ההשהיה הייתה צריכה להגיע מוקדם יותר. "זה בהחלט מאוחר מדי", אמר לדיש. "אין ספק שאנחנו בשלב שבו אנחנו צריכים לאבד אמון בכך שחברות AI יכולות לבצע רגולציה עצמית". לדיש סבור ש-OpenAI הייתה צריכה להשהות את פיתוח Astra כבר עם זיהוי המעורבות של המודלים שלה בפרצה ל-Hugging Face, ולא להמתין למבדקים הפנימיים הנפרדים.

מקור: calcalist.co.il