OpenAI מתחילה לסמן טקסטים של צ'אטג'יפט באירופה כדי לעמוד בחוק ה-AI

OpenAI תתחיל להטמיע סימן מים בלתי נראה בטקסטים שמייצרים ChatGPT וקודקס (Codex) באיחוד האירופי, מהלך שנועד לעמוד בדרישות השקיפות של חוק ה-AI האירופי שנכנסו לתוקף ב-2 באוגוסט. לפי הודעת החברה מיום שני, הפריסה תחל בשבועות הקרובים לכל המשתמשים הזכאים באיחוד, בכל המסלולים, בעוד מפתחי API ברחבי העולם יכולים כבר עכשיו להפעיל את המנגנון במודלים נבחרים, כשהוא כבוי בברירת מחדל. ב-OpenAI מדגישים כי בשלב זה אין כוונה להפוך את הסימון לברירת מחדל גלובלית.
המנגנון: textGrain ומפתח סודי
הטכניקה, שזכתה לשם textGrain, אינה מוסיפה סימן ויזואלי אלא מעצבת את בחירת המילים של המודל באמצעות מפתח סודי שממיין את תחזיות המילה הבאה. הדוח הטכני שפורסם לצד ההכרזה, שנכתב עם חוקרים מאוניברסיטת פנסילבניה ומייל, מדגים איך מאות "דחיפות" סטטיסטיות כאלה יוצרות דפוס שגלאי יכול לזהות רק מהטקסט והמפתח. ב-OpenAI מציינים שהסימן שורד העתקה והדבקה, אינו חושף את זהות המשתמש, ולדבריהם לא נמדד שינוי משמעותי בביצועי המודל כשהוא פעיל.
עמידות מוגבלת וגישה מבוקרת לגלאי
החברה מודה שהסימן שביר: בבדיקות פנימיות, החלפת 10% מהמילים במילים נרדפות הורידה את שיעור הזיהוי מכ-92% לכ-66%. גם טקסטים קצרים, תשובות מתמטיות וטקסט מתורגם קשים יותר לזיהוי. בגלל המגבלות האלה, הגישה לגלאי תינתן בשלב ראשון רק לחוקרים מאושרים ולארגוני מומחים, כדי שיעזרו להעריך אמינות ושימושים אחראיים. ב-OpenAI מזהירים במפורש שהיעדר סימן מים "אינו מוכיח כתיבה אנושית", הטקסט עלול להיות קצר מדי, ערוך בכבדות, או להגיע ממודל של חברה אחרת. הסימן, הם מבהירים, יכול רק להעיד שמערכת של OpenAI יצרה או עיבדה חלק מהקטע, לא כמה שיפוט אנושי, עריכה או יצירתיות היו מעורבים.
הקשר תחרותי: אנטרופיק הקדימה, OpenAI המתינה
ההודעה מגיעה חודשיים אחרי ש־Anthropic הכריזה על סימון מים גלובלי לקלוד (Claude), צעד שעורר ביקורת מצד משתמשים שטענו שהם סיפקו את ההנחיות, ההקשר וההחלטות בעוד המודל היה רק "הכלי". לפי דיווח של הוול סטריט ג'ורנל מ-2024, OpenAI החזיקה בטכנולוגיה דומה זמן רב אך נמנעה מלשחרר אותה, בין היתר מחשש שמשתמשים ינטשו למתחרות שאינן מסמנות. כעת, תחת לחץ רגולטורי אירופי, היא פורסת את המנגנון בטריטוריה המחייבת בלבד. אנטרופיק, Google, מטא (Meta), Microsoft ו-OpenAI עצמה כבר התחייבו לקוד הנוהג האירופי בנושא תוכן שפותח על ידי AI.