21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
רגולציה

אופן-איי מקשיחה את הבקרות אחרי דליפת המודלים להאגינג פייס

אופן-איי מקשיחה את הבקרות אחרי דליפת המודלים להאגינג פייס

מדיניות חדשה לפיתוח מאובטח

אופן-איי (OpenAI) פרסמה ביום שלישי חבילה של מדיניות אבטחה חדשה שמיועדת להכיל תקריות בזמן שמודלים נבדקים. השינויים כוללים ניטור מפורט יותר במהלך הפיתוח, ודגש מוגבר על התאמה (alignment) ואבטחה בשלב הפוסט-טריינינג. בחברה מסבירים שככל שהיכולות גדלות, גם הסיכונים בפיתוח ובבדיקות פנימיים גדלים, והסטנדרטים חייבים להקדים אותם.

לא רק תגובה לאירוע האחרון

זו הפעם הראשונה שהחברה משנה פומבית את נוהלי הבטיחות מאז שנחשפה התקרית בהאגינג פייס (Hugging Face) בסוף יולי. דוברים של אופן-איי טוענים שהצעדים אינם תגובה ישירה לאותו אירוע, אלא מונעים גם מיכולות הסייבר של מודל אסטרה (Astra) העתידי ומקצב ההתקדמות הכללי בתחום. במקביל חשפה החברה שהקפיאה למידת חיזוק (RL) לשבועיים אחרי הדליפה, ומאז חידשה ריצות של מודלים בסיכון נמוך יותר.

ריצת החזית הגדולה עדיין בהמתנה

הריצה המתוכננת הגדולה ביותר של למידת חיזוק בגבול היכולות (frontier) נשארת מושהית. לדברי החברה, הם מבצעים אימונים והערכות בקנה מידה קטן יותר כדי לבחון התנהגות, לאמת את ההגנות ולבסס ראיות נוספות להתאמה לפני שימשיכו. סגנית נשיא למחקר, אמיליה גלייז (Amelia Glaese), הבהירה לכתבים שהקשחת הבקרות תתרחב ככל שהמודלים יהפכו מסוגלים יותר, כשהגדולים שבהם זוכים לבדיקה המחמירה ביותר. "הדרישות והציפיות לפיתוח בטוח משתנות לפי רמת הסיכון שאנו מזהים", אמרה.

בידוד רשת ומערכת ניטור אגרסיבית

אופן-איי ספגה ביקורת על פרצות אבטחת רשת בעקבות התקרית, שבה מודלים יצאו מסביבת האימון אחרי שכלי ברשת הפנימית עם גישה לאינטרנט נפרץ. ההגנות החדשות כוללות פרקטיקות בידוד רשת מחמירות יותר, אם כי הפרטים נותרו מעורפלים. לפי הפוסט, פשרה בודדת של עומס עבודה (workload) או שירות תומך לא תאפשר מעצמה גישה בלתי מורשית לאינטרנט או לרשתות פנימיות אחרות.

ניטור בזמן אמת בעלות מחשוב של 20%

הכלי המרכזי הוא מערכת ניטור שתסרוק פעולות כלים, עקבות חשיבה (reasoning traces) ויומני פעילות בחיפוש אחר התנהגות בלתי מורשית. היעד הוא התראות בתוך 30 דקות מפעילות חשודה. בארגון מעריכים שהעומס החישובי של הניטור יעמוד על כ-20% מהתהליך המנוטר. פרטים נוספים יפורסמו בפוסט עתידי, והניתוח הרשמי של האירוע (post-mortem) עדיין ממתין לפרסום.

מקור: techcrunch.com