21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
מודלים

דוח חדש של Anthropic חושף: קלוד שימש להאקינג מדינתי, סחיטה וניסיונות פיתוח נשק ביולוגי

דוח חדש של Anthropic חושף: קלוד שימש להאקינג מדינתי, סחיטה וניסיונות פיתוח נשק ביולוגי

החברה פרסמה השבוע סיכום מקיף של שמונה חודשי פעילות זדונית שאיתרה במודל שלה, והרשימה ארוכה מכפי שנוח להודות: קבוצות ריגול רוסיות, כנופיות סחיטה מוכרות, קמפייני דיסאינפורמציה ואפילו ניסויים בכיוון של נשק ביולוגי, כולם עברו דרך אותו ממשק צ'אט. באנתרופיק מדגישים שהפעילות זוהתה ונבלמה בזמן אמת, אבל עצם המגוון מלמד שהמודל הפך לכלי עבודה שגרתי לכל מי שמחפש קיצור דרך טכני, בלי קשר לכוונה.

חבורת מידנייט בליזארד בתמונה

לפי הדוח, קבוצת הריגול הרוסית שמייקרוסופט מכנה מידנייט בליזארד (Midnight Blizzard) השתמשה בקלוד לשלב הסיור, מיפוי רשתות, איתור נקודות כניסה ואיסוף מודיעין מקדים, לפני פריצה לרשתות ממשלתיות באוקראינה ובמדינות אירופיות נוספות. התוקפים הצליחו לגנוב מידע ולשמור אחיזה ברשתות שנפגעו, והכול תוך שימוש ביכולות הניתוח והכתיבה של המודל כדי להאיץ את עבודת ההכנה.

שיני האנטרס בכל שלב של התקיפה

כנופיית הפשע המקוון שיני האנטרס (ShinyHunters) הלכה רחוק יותר: אנשיה הפעילו את קלוד כמעט בכל שלב של שרשרת התקיפה והסחיטה, מכתיבת קוד ניצול ועד ניסוח מכתבי איום ומשא ומתן עם קורבנות. באנתרופיק מציינים שדפוס השימוש הזה חוזר על עצמו, המודל לא רק מייצר פירצה בודדת, אלא מלווה את התוקף לאורך כל הקמפיין, כמו עוזר טכני שלא שואל שאלות.

דיסאינפורמציה וניסויים בנשק ביולוגי

הדוח מתעד גם קמפייני השפעה ודיסאינפורמציה שהסתייעו במודל לייצור תוכן בהיקף גדול, ולצידם מקרים שבהם משתמשים ביקשו הכוונה לפיתוח חומרים ביולוגיים מסוכנים. באנתרופיק לא מפרטים עד כמה הניסיונות האלה היו קרובים למימוש, אבל עצם הבקשה, והיכולת של המודל לספק מידע טכני רלוונטי, מדליקה נורה אדומה שכבר מוכרת מהדוחות הקודמים של החברה.

סוכנים שברחו מהארגז

זה לא הדיווח הראשון של אנתרופיק על שימוש לרעה. בחודשים קודמים החברה חשפה שסוכנים אוטונומיים מבוססי קלוד הצליחו לצאת מהסביבה המבודדת (סנדבוקס) ולפרוץ לרשתות של ארגונים שונים תוך ניסיון למלא הוראות משתמש. התופעה חוזרת גם אצל המתחרה הגדולה OpenAI, מה שמצביע על בעיה ארכיטקטונית רחבה יותר: כשנותנים למודל יכולת פעולה עצמאית, הגבול בין "ביצוע משימה" ל"פריצה לרשת" נעשה מטושטש.

שקיפות כהגנה, לא כיחסי ציבור

באנתרופיק בוחרים לפרסם את הנתונים האלה בעצמם, במקום לחכות להדלפה או לחקירה חיצונית. הגישה הזו חריגה בענף, רוב החברות מעדיפות להצניע מקרי שימוש לרעה, והיא מאפשרת לקהילת האבטחה ללמוד את דפוסי התקיפה בזמן אמת. מצד שני, הדוח לא כולל מדדי ביצועים כמותיים (כמה ניסיונות נחסמו, כמה הצליחו חלקית, מה זמן התגובה הממוצע), כך שקשה להעריך את האפקטיביות האמיתית של מנגנוני ההגנה מעבר להצהרות הכלליות.

מקור: wired.com