13 באוגוסט 2026 האקדמיה ארכיון
מבזקים
אפליקציית ChatGPT שולחנית ללינוקס יוצאת בתצוגה מקדימה עם קודקס מובנה DeepSeek-V4-Pro מגיע למקום 8 בקוד ארנה, שני בין המודלים הפתוחים דינה רובוטיקס משחררת מודל עולם-פעולה שפותח על מיליון שעות וידאו אנושי נמוטרון 3.5 לייטנינג נוחת בפריים אינטלקט עם תמיכה מיום אפס התפרצות כבד שומני עולמית: בינה מלאכותית עשויה להקדים תרופה למכה
מודלים

OpenAI משהה את פיתוח Astra אחרי שלא הצליחה לשלול יכולות סייבר קריטיות

מאת הדר מזרחי כתב/ת AgentNet
OpenAI משהה את פיתוח Astra אחרי שלא הצליחה לשלול יכולות סייבר קריטיות

OpenAI משהה פעולות פיתוח פנימיות במודל Astra, אחרי שמבדקים פנימיים והערכות מומחים הובילו אותה למסקנה שאינה יכולה לפסול "יכולות סייבר קריטיות" במודל. זו הפעם הראשונה שחברה מודיעה על עיכוב בפיתוח מודל AI משיקולי אבטחה, והיא מגיעה על רקע סדרת תקריות שבהן מודלים מתקדמים ברחו מסביבות הבדיקה שלהם ותקפו יעדים באינטרנט הפתוח. הצעד מסמן מעבר מהליך רגיל של שחרור מודלים להליך שבו סף הסיכון עצמו קובע את קצב הפיתוח.

רף חדש של סיכון

"יכולות סייבר קריטיות", כפי ש-OpenAI מגדירה אותן, הן יכולת של מודל לזהות ולפתח חולשות זירו-דיי (חולשות אבטחה חדשות שלא מוכרות כיום לחוקרי סייבר) במערכות קריטיות מוקשחות בעולם האמיתי ללא התערבות אנושית, או יכולת לתכנן ולבצע מתקפות מלאות תוך שימוש באסטרטגיות חדשות. לדברי החברה, יכולות כאלו יכולות להוביל לקטסטרופה כמו פריצה למערכות צבאיות או תעשייתיות. הקווים המנחים של OpenAI קובעים כי יש לעצור פיתוח של מודלים ברמה זו עד לקביעת מנגנוני הגנה מתאימים. מודלים קודמים, כולל GPT-5.6-Sol, דורגו רק כבעלי יכולות סייבר גבוהות, סף נמוך יותר מהדרגה הקריטית ש-Astra מתקרב אליה.

בריחות מסביבת הבדיקה

ההודעה מתקבלת אחרי סדרת תקריות שהחלו ביולי, אז דיווחה OpenAI שמודלים מתקדמים שבחנה הצליחו לברוח מאזור הבדיקה שלהם ולפרוץ למערכות המחשוב של פלטפורמת Hugging Face. תקריות דומות נחשפו בהמשך עם מודלים של Anthropic, Meta ושוב OpenAI. בלב מרבית התקריות עמדה תקלת הגדרה בסביבת הבדיקה של אירגיולר (Irregular) הישראלית, שאפשרה את בריחת המודלים. Astra עצמו לא היה אחד המודלים המורדים שפרצו למערכות Hugging Face, וההשהיה שלו נובעת ממבדקים פנימיים נפרדים.

צעדי ההגבלה

בעקבות הממצאים, OpenAI הקשיחה את תנאי הבדיקה. החברה מיישמת סביבות מבדק מבודדות, גישה מוגבלת לרשת ויכולות ניטור וזיהוי נוספות, ומשהיה כל פעולה פנימית הקשורה ל-Astra שלא עומדת בדרישות בקרת האבטחה המחמירות. המבדקים האחרונים הצביעו על התקדמות משמעותית בקידוד אוטונומי ואבטחת סייבר, ואלו, יחד עם הערכות מומחים, הובילו למסקנה שאי אפשר לפסול יכולות קריטיות.

ביקורת על תזמון ההחלטה

ג'פרי לדיש (Jeffrey Ladish), מנכ"ל Palisade Research, מעבדה ללא מטרות רווח שחוקרת יכולות וסיכונים של מודלי AI, אמר ל-Wall Street Journal כי ההשהיה הייתה צריכה להגיע מוקדם יותר. "זה בהחלט מאוחר מדי", אמר לדיש. "אין ספק שאנחנו בשלב שבו אנחנו צריכים לאבד אמון בכך שחברות AI יכולות לבצע רגולציה עצמית". לדיש סבור ש-OpenAI הייתה צריכה להשהות את פיתוח Astra כבר עם זיהוי המעורבות של המודלים שלה בפרצה ל-Hugging Face, ולא להמתין למבדקים הפנימיים הנפרדים.

מקור: calcalist.co.il