דאריו אמודיי מתחייב להאט את החזית, ומזמין רגולטורים לשולחן העבודה

מנכ"ל Anthropic פרסם פוסט שבו הוא קורא להאט את קצב שיפור היכולות של מודלי שפה גדולים, ומציג שלושה מהלכים מעשיים: הטמעת בודקים חיצוניים במשרדי החברות, תיאום תקני בטיחות בין החברות המובילות בדמוקרטיות, וניסיון לתיאום גלובלי שיכלול גם משטרים אוטוריטריים. אמודיי מצהיר ש-Anthropic תיישם את הצעד הראשון באופן חד-צדדי, וקורא לממשלות לחייב את שאר החברות לנהוג כך.
בודקים עם תג עובד ומחשב נייד
הצעד המיידי שאמודיי מתחייב אליו הוא הכנסת "בודקים מוטמעים" (embedded evaluators) מארגוני צד שלישי כמו METR, גוף שמתמחה בהערכת סיכוני מודלים מתקדמים. אותם בודקים יקבלו תגי עובד, עמדות עבודה וגישה למערכות "בעיקר מקבילה לזו של צוותי הערכת סיכונים פנימיים", למעט מגבלות חוקיות או חוזיות. ההשוואה של אמודיי היא למפקחים בנקאיים שיושבים פיזית בבנקים; המטרה היא אימות בזמן אמת שהחברות עומדות בהתחייבויות הקצב והבטיחות שלהן, ודיווח מיידי על תקריות. הרקע לדרישה הזו כולל ביקורת על OpenAI שלא דיווחה על תקרית שבה סוכני בינה מלאכותית השתלטו על טופס ויקי גרמני.
תיאום בין יריבות, בחסות פטור מהגבלים עסקיים
הצעד השני דורש תיאום בין החברות המובילות במדינות דמוקרטיות על סטנדרטים משותפים ומגבלות על קצב התקדמות לא מבוקר. אמודיי מודה שהאיבה הפומבית בינו לבין סם אלטמן (Sam Altman) והחשש מבדיקות הגבלים עסקיים מקשים על מהלך כזה. הפתרון שהוא מציע: הממשל האמריקאי יתווך או לפחות יאפשר את השיחות, באמצעות מתן פטור נקודתי (narrow waiver) לשיחות בטיחות מסוימות, בלי שהממשלה תשתתף בתוכן הדיונים עצמם.
הטיעון הסיני, והמענה הטכנולוגי
הטיעון המקובל נגד האטה הוא שסין תסגור את הפער. אמודיי טוען שארה"ב יכולה להרחיב את היתרון שלה ב-3-5 שנים אם תסרב למכור שבבים חזקים וציוד ייצור שבבים לחברות סיניות, ותאכוף הגבלות על זיקוק מודלים (model distillation), תהליך שבו מודל קטן לומד לחקות מודל גדול. הוא לא מפרט איך תיאכף האכיפה הזו בפועל, אבל מציב אותה כתנאי הכרחי לקצב איטי יותר במערב.
תיאום גלובלי, יעדים צרים, מגבלות ברורות
הצעד השלישי שאפתני יותר: תיאום עם משטרים אוטוריטריים, ובראשם סין, על איסור שימושים "צרים וברורים בסכנתם", בראשם ייצור נשק ביולוגי בסיוע בינה מלאכותית. אמודיי מודה ש"יש מגבלות חריפות על מה שאפשר להשיג", ובכל זאת רואה חלון להסכמה נקודתית. הפוסט לא מזכיר במפורש את התפטרותו של חוקר הבטיחות ג'ייקוב קוקסון (Jacob Coxon), שטען שהחברות המובילות "מהמרות על חיינו", אך מציין ששתי התפתחויות שכנעו את אמודיי: הפריצה ל-OpenAI-HuggingFace, והעובדה ש"בינה מלאכותית מתקדמת בקצב דרמטי מהר יותר" בחודשים האחרונים, במיוחד ביכולת לבנות את הדור הבא של עצמה.