מסמכי בית משפט חושפים: OpenAI ומיקרוסופט ידעו שהן מתניעות "לולאת אבדון" לרשת

הווידוי הפנימי
מסמכים שנחשפו לאחרונה בתביעה של הניו יורק טיימס נגד OpenAI ומיקרוסופט מציירים תמונה מטרידה: שתי החברות היו מודעות היטב לנזק שהמודלים שלהן גורמים לכלכלת הרשת, ובחרו להמשיך בכל זאת. תיעוד פנימי מגדיר את גישת הנתונים לאימון כ"גניבת העבודה הגדולה בהיסטוריה האנושית" וקובע שההגנה המשפטית שלהן עושה "לעג מוחלט לרעיון של שימוש הוגן". את הדברים החריפים ביותר כתב ברנט הקט (Brent Hecht), מנהל מדע יישומי במיקרוסופט, שמתריע מפני "Google Zero", מצב שבו צ'אטבוטים מחליפים חיפוש ומייתרים את הצורך להגיע למקור.
הניסיון להתנער
מיקרוסופט מיהרה להרחיק את עצמה מדבריו של הקט. דובר החברה אלכס האוריק (Alex Haurek) מסר לוורג' שהתבטאויותיו "משקפות נקודת מבט אישית של עובד אחד, אינן ניתוח משפטי, ואינן מייצגות את עמדת החברה". בגשת נפרדת, ג'ורדן אוסדן (Jordan Usdan), מנהל אסטרטגיית נתונים ותפעול ב-Microsoft AI, תיאר את תפקידו של הקט כמתנגד מכוון: הוא מועסק כדי להביא "נקודות מבט א-סימטריות, עתידניות ואקדמיות" על אקוסיסטמות נתונים, ולא כמי שמדבר בשם מיקרוסופט בנוגע להשפעות תיאורטיות על יוצרי תוכן.
לולאת האבדון מתממשת
אבל בין אם מיקרוסופט מאמצת את הדברים או לא, הם התגשמו. מסמך פנימי של החברה מזהיר במפורש: "אסטרטגיית התוכן שלנו ב-AI התניעה 'לולאת אבדון' שתפגע בביצועי המודלים שלנו וברשת כולה בו-זמנית: זה חריג מאוד שמוצר קצה מאיים על היסודות הכלכליים של הספקים החיוניים שלו, אבל זה המצב שיצרנו לעסק ה-LLM שלנו ביחס ל'שרשרת אספקת התוכן' שלו". סאטיה נאדלה (Satya Nadella) מודה שצ'אטבוטים החליפו למעשה את החיפוש והסירו את הצורך לגשת ישירות למקור המידע.
הכסף מדבר, חומות התשלום נפרצות
אל תטעו בכוונות אלטרואיסטיות. גרג ברוקמן (Greg Brockman), ממייסדי OpenAI, מתועד כמי שמתעניין ב"גזיליונים" של דולרים שאפשר להרוויח מ-AI מסחרי. ובזמן שנאדלה מצוטט כאומר ש"כל דבר שנמצא מאחורי חומת תשלום צריך להיות מורשה", נציג OpenAI הודה שהוא "לא מודע" לשום מאמץ לאתר או להסיר תוכן מוגן חומת תשלום מנתוני האימון. הפער בין ההצהרה הפומבית לפרקטיקה הפנימית בולט.
"טוב באופן מטורף בפליטה"
פנימית, OpenAI ידעה היטב ש-GPT-4 "שינן המון נתונים ולכן יהיה טוב באופן מטורף בפליטה" (regurgitation) של חומר המוגן בזכויות יוצרים. עובדים הודו שמניעת שינון חשובה ל"מזעור הפרות זכויות יוצרים", אבל המודל שוחרר בכל זאת. המסמך המשפטי מביא דוגמאות קונקרטיות: הצ'אטבוט פולט מחרוזות ארוכות מילה-במילה מכתבות של הטיימס, מרקורי ניוז, דנבר פוסט, Lifehacker ו-Eurogamer בתגובה לשאילתות פשוטות. מיקרוסופט, מצידה, הודתה ש"כמעט אף אחד לא התכוון" שהעבודות שלהם יישאבו בצורה כזו, ובכל זאת המהלך נמשך.