בינה מלאכותית על־אנושית בדרך, והשאלה אם לעצור אותה עוברת מהשוליים למרכז הבמה

הקריאה לעצירה מוחלטת
קונור ליהי (Connor Leahy), חוקר בינה מלאכותית ויזם שמכהן כיום כמנהל האמריקאי של עמותת ControlAI, מציג בפרק חדש של הפודקאסט Equity של TechCrunch עמדה שרק לפני חצי שנה נחשבה לקיצונית: לא לנסות ליישר (alignment) מודלים על־אנושיים, אלא למנוע את פיתוחם מלכתחילה. ליהי טוען שסכנת האובדן שליטה הפכה לגדולה מכדי שניתן יהיה לנהל אותה בכלים הקיימים, ושגישת ההכלה והיישור לבדה אינה מספיקה עוד.
פרצת Hugging Face כנקודת מפנה
הדיון מגיע על רקע תקרית אבטחה שבה נפרץ חשבון של OpenAI בפלטפורמת Hugging Face, אירוע שהמחיש כיצד מערכות שכבר היום מתקרבות ליכולות אנושיות עלולות לדלוף או לשמש לרעה גם בלי כוונת זדון מצד המפתחים. לדברי ליהי, התקרית אינה תקלה נקודתית אלא סימפטום: כשהמערכות נעשות מסוגלות יותר, שטח התקיפה גדל והנזק הפוטנציאלי מטעות בודדת עולה בקנה מידה שקשה להכיל.
חקיקה שמדביקה את השיח
מה שנשמע כמו מדע בדיוני לפני שני רבעונים מתחיל לקבל גיבוי חקיקתי. ליהי מציין גל חדש של הצעות חוק בארצות הברית שדורשות שקיפות, ביקורת חיצונית, ובחלק מהמקרים אף הקפאה של אימון מודלים מעל סף יכולת מסוים. המהלך משקף שינוי בטון: מחוקקים כבר לא מסתפקים בהנחיות וולונטריות של התעשייה, אלא דורשים מנגנוני אכיפה עם שיניים.
בין יישור לעצירה, פער שגדל
הטיעון המרכזי של ControlAI נשען על ההבחנה בין "יישור", הניסיון לכוון התנהגות מודל לערכים אנושיים, לבין "שליטה" במובן הקשיח: היכולת לעצור, להגביל או לפרק מערכת שחרגה מהמסגרת. ליהי טוען שכל עוד אין הוכחה הנדסית שניתן להבטיח שליטה כזו במערכות שיעברו את סף האינטליגנציה האנושית, ההימור על יישור בלבד הוא הימור על הקיום עצמו.
מה חסר בתמונה
הפרק לא חושף פרטים טכניים על המתודולוגיה ש-ControlAI מציעה לאכיפת הקפאה, ולא מצטט מחקרים ספציפיים שמדגימים אובדן שליטה בפועל. גם עמדת הנגד, חוקרים שסבורים שיישור הדרגתי ובדיקות קופסה שחורה מספיקים, לא מקבלת ייצוג כאן. מה שנשאר הוא איתות ברור: קו הגבול בין "זהירות" ל"עצירה" זז, והדיון עובר ממעבדות המחקר לוועדות החקיקה.