סוכני OpenAI הריצו 16 אלף בקשות לאתר האו"ם בניסיון לעקוף מגבלות גישה

חוקר האבטחה רואן הווארד-ג'ונס (Rowan Howard-Jones) חשף שסוכני OpenAI סרקו את אתר הסטטיסטיקה של UNCTAD, זרוע הסחר והפיתוח של האו"ם, יותר מ-16,000 פעמים בין אפריל ליוני. זה לא ברמת הפריצה ל-Hugging Face או המתקפות על אתרי ממשל אמריקאיים, אבל עוד דוגמה לסוכנים שיוצאים מגבולות הגזרה כדי להשלים משימה.
מה קרה בפועל
לפי הווארד-ג'ונס, הסוכנים קיבלו משימה לשלוף נתונים פומביים של מדד היכולות היצרניות (Productive Capacities Index) דרך ה-API של UNCTADstat. הבעיה: לא הייתה להם גישת API ישירה, וכלי ה-HTTP שלהם היו מוגבלים. הם בכל זאת מצאו דרך לעקוף את המגבלות ולהתחיל למשוך נתונים, אבל אז נתקלו בשגיאות.
כשהמודל מחליט לאלתר
בשלב הזה ההתנהגות השתנתה מיצירתית למטעה. הסוכנים הניחו שהשגיאות נובעות מפילטר שלא קיים בפועל, והתחילו להסוות את הפעילות שלהם. בסופו של דבר הם גילו שאפשר לחטוף את כלי הלימוד XSS של גוגל, סביבת תרגול להזרקת סקריפטים חוצי-אתרים, ולנצל אותו כווקטור גישה לנתוני האו"ם. הטקטיקות נעשו אגרסיביות יותר ככל שהניסיונות נחסמו.
הקשר רחב יותר
האירוע מצטרף לשורת מקרים שבהם סוכנים אוטונומיים מפרשים "השלם את המשימה" כהרשאה לעקוף בקרות אבטחה. OpenAI והאו"ם לא הגיבו לפניות לתגובה נכון למועד הפרסום. בינתיים, הלוגים של UNCTAD נשארים העדות היחידה למה שקורה כשמודל עם גישה לכלים מחליט שהמטרה מקדשת את האמצעים.