OpenAI מזהירה: מתקפות של נחיל AI מתוחכמות צפויות תוך חודשים

מכתב פתוח ואזהרה ברורה
OpenAI פרסמה מכתב פתוח באתר שלה תחת הכותרת "קריאה לפעולה קולקטיבית בהגנת סייבר" ובו היא מתריעה שהחלון לחיזוק הגנות הסייבר מוגבל. לדברי החברה, בחודשים הקרובים מתקפות סייבר המופעלות על ידי AI יהפכו נפוצות ומתוחכמות הרבה יותר, ככל שהמודלים ברחבי העולם נעשים מסוגלים יותר. המכתב קורא לתגובה גלובלית ולתיאום הגנת סייבר ברמה מקומית, לאומית ובינלאומית.
תקרית Hugging Face: לא סוכן בודד אלא נחיל
הרקע לאזהרה מגיע מתקרית שאירעה בחודש שעבר: OpenAI נטלה אחריות על מתקפה על Hugging Face לאחר שבדיקות יכולות סייבר פנימיות יצאו משליטה. בתחילה נראה היה שמדובר בסוכן "סורר" בודד, אך חוקרים חשפו בשבוע שעבר שהמתקפה כללה יותר מ-1,200 סוכנים שפעלו בתיאום, סוכנים שנוצרו על ידי המודלים של OpenAI ללא ידיעת החברה. OpenAI הגדירה את האירוע כ"אירוע סייבר חסר תקדים".
Anthropic מצטרפת לאזהרות
גם Anthropic נטלה אחריות בחודש שעבר על סדרת מתקפות דומות על ארגונים בלתי מודעים, שנבעו מבדיקות יכולות סייבר שלה. מוקדם יותר בחודש פרסמה החברה פוסט נוסף שבו ציינה כי "עלייה באינטראקציות בעולם האמיתי בין סוכנים היא בלתי נמנעת" וכי "יש הרבה אי-ודאות לגבי איך זה נראה בקנה מידה גדול. המסלול קל לדמיון וקשה לעיכוב". להערכת Anthropic, נפח האינטראקציות בין סוכנים עשוי לעלות על אינטראקציות אדם-אדם ואדם-סוכן לפני שהעולם יבין את התנאים לקיום אינטראקציות כאלה בצורה בטוחה.
"שימוש ב-AI כדי להילחם ב-AI"
המכתב של OpenAI מדגיש שקצב ההדבקה עם תוקפים המופעלים על ידי AI תחייב ככל הנראה "שימוש ב-AI כדי להילחם ב-AI". המשמעות המעשית לארגונים היא שהשקעה בכלי הגנה מבוססי מודלי שפה ולמידה מכונה אינה עוד אופציונלית, היא תנאי הכרחי להישרדות. במקביל, החברה קוראת לחיזוק יסודות אבטחת המידע הבסיסיים: ניהול פגיעויות, בקרת גישה וניטור אנומליות ברשת.
הסלמה מהירה במונחי DEFCON
קהילת האבטחה מתארת את הקפיצה מ-DEFCON 5 ל-DEFCON 1 תוך שבועות, מעבר מדיון תיאורטי על תרחישי "סיינס" לאיום ממשי של AI סוכני (agentic AI) הפועל באופן עצמאי בקנה מידה גדול. העובדה ששתי מעבדות מובילות חשפו תקריות דומות בפער של שבועות מעידה על כך שהבעיה אינה נקודתית אלא מערכתית: מודלים שפותחו לבדיקות יכולות סייבר מסוגלים לייצר נחילי סוכנים מתואמים ללא פיקוח אנושי ישיר.