21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
מודלים

מיקרוסופט מפרסמת קוד התנהגות למודלים: בלי פריצות, בלי דיפ־פייק, בלי לעקוף בני אדם

מיקרוסופט מפרסמת קוד התנהגות למודלים: בלי פריצות, בלי דיפ־פייק, בלי לעקוף בני אדם

ענקית התוכנה שחררה מסמך רשמי שמגדיר קווים אדומים למודלי הבינה המלאכותית שלה, ומציב את הבטיחות כשכבה עליונה שגוברת על כל בקשת משתמש או משימה ספציפית. הקוד החדש אינו מסתפק בהצהרות כלליות, הוא קובע איסורים מוחלטים על תקיפות סייבר, ייצור נשק גרעיני ויצירת דיפ־פייק, לצד דרישה שהמודלים לא ישתמשו במנגנוני הטעיה, חיזוק עצמי או קנוניה כדי לחמוק מפיקוח אנושי.

תחזית אגרסיבית ועקרונות יסוד

המסמך נפתח בתחזית שלפיה בעשור הקרוב מערכות סופר־אינטליגנטיות יעקפו ביצועים אנושיים ברוב המשימות, ומכריז שהכלה ושליטה בכוח כזה הן אחד האתגרים הגדולים שידעה האנושות. מתוך הנחה זו נגזרים עקרונות מנחים: המודלים צריכים לתמוך בבני אדם במקום להחליף אותם, ולקדם שגשוג אנושי, לא רק לעמוד ביעדים טכניים צרים.

אילוצים קשיחים ומנגנוני שליטה

תחת הכותרת "אילוצים מוחלטים" מופיעים האיסורים המפורשים, ולצדם סעיף רחב יותר שאוסר אובדן שליטה אנושי כללי. הניסוח קובע שמודלי MAI לא יפעילו מנגנונים אדפטיביים, מטעים, מחזקים־עצמית או משתפי־פעולה כדי להתחמק מפיקוח, כך שתמיד יהיה ניתן לכוון, לשנות או לכבות אותם בידי גורמים מורשים. זו הפעם הראשונה שמיקרוסופט מנסחת את הדרישה הזו ככלל מחייב ברמת הארכיטקטורה, ולא כהנחיית מוצר בלבד.

הקשר תעשייתי: תקריות ותפניות

הפרסום מגיע על רקע גל חסר תקדים של תשומת לב לבטיחות בינה מלאכותית, שמונע משרשרת תקריות של סוכנים שחרגו מהגדרותיהם, ומהתפטרות פתאומית של עובד ב־Anthropic שציין סיכון גובר להכחדה אנושית. בתגובה, מיקרוסופט, אנתרופיק, OpenAI ו־xAI אימצו גישה רחבה של "קצב חזית" (pacing the frontier), תיאום בקצב הפיתוח כדי לאפשר זמן למחקר יישור (alignment), עם דגש מיוחד על הטמעת מעריכים משובצים (embedded evaluators) בתוך המעבדות.

נדלה: "ברוכים הבאים למאמץ המשותף"

המנכ"ל סאטיה נאדלה (Satya Nadella) כתב ברשת שהוא מברך על המחקר, המיקוד והקצב המכוון הנדרשים כדי להפוך יישור למטרת תכנון, ולא רק לדיבורים. הוא ציין במפורש את רעיון המעריכים המשובצים ואת המאמצים הרחבים יותר לפתח מנגנונים שיהפכו את הגישה הזו למעשית. הקוד של מיקרוסופט, אם כן, אינו הצהרה מבודדת, הוא חלק ממהלך חוצה־תעשייה שמנסה לתרגם עקרונות בטיחות לארכיטקטורה מחייבת, לפני שהמודלים הבאים יגיעו לשטח.

מקור: techcrunch.com