21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
מחקר

גוגל דיפמיינד חושפת את SIMA 2, סוכן כללי שמשחק בלי גישה לקוד

גוגל דיפמיינד חושפת את SIMA 2, סוכן כללי שמשחק בלי גישה לקוד

חמש עשרה שנה של משחקים כמנוע מחקר

דיפמיינד מציינת חמש עשרה שנה להקמתה עם פרסום שמסכם את המסלול מאטארי ועד EVE Online, ומדגישה שמשחקים היו ונשארו זירת הניסוי המרכזית של המעבדה. דמיס האסאביס, ממייסדי החברה, הגיע מעולם פיתוח המשחקים, ורבים בצוות חולקים את אותו רקע, מה שהפך את השותפות עם אולפנים לצורך טבעי ולא לאילוץ שיווקי. השנה נחשפה שותפות מחקר גדולה עם Fenris Creations והיקום של EVE, לצד עבודה משותפת עם Hello Games, Coffee Stain Studios ו-Foulball Hangover.

מה-DQN לאלפא-ג'ירו דרך למידת חיזוק

הצעד הראשון הגיע ב-2015 עם מאמר ה-Nature על DQN, רשת נוירונים שלמדה לשחק 49 כותרי אטארי 2600 ישירות מפיקסלים גולמיים, בלי הנדסה ספציפית לכל משחק. העבודה הזו הניעה את העידן המודרני של למידת חיזוק עמוקה (Deep Reinforcement Learning). משם התקדמו לאתגרים מורכבים יותר: אלפא-גו (AlphaGo) ניצח את אלוף העולם לי סה-דול (Lee Sae Dol) ב-2016, מהלך 37 המפורסם הפך לסמל לחשיבה שהאנושות לא העלתה על דעתה. אלפא-גו זירו (AlphaGo Zero) עקפה את כל הגרסאות הקודמות בלמידה עצמית בלבד, בלי נתוני אדם. אלפא-זירו (AlphaZero) הכליל את השיטה לשחמט, שוגי וגו באלגוריתם אחד, ומיו-זירו (MuZero) למדה לשחק בלי להכיר את החוקים מראש. ב-2019 אלפא-סטאר (AlphaStar) הגיעה לדרגת גראנדמאסטר ב-StarCraft II, תוך התמודדות עם מורכבות בזמן אמת ומידע חלקי.

מהשגת ניקוד להבנת עולם המשחק

ההישגים האלה הוכיחו ש-AI מסוגל למקסם ניקוד בהינתן מטרה ברורה, אבל העולם האמיתי לא מגיע עם ספר חוקים וניקוד. השאלה הבאה הייתה האם סוכן יכול להבין עולם משחק ולפעול בו כמו אדם, בלי API, בלי קוד מקור, רק ממה שרואים על המסך. כאן נכנס SIMA, ראשי תיבות של Scalable Instructable Multiworld Agent. בניגוד למודלים קודמים, SIMA לא מכוון לניקוד גבוה אלא לפעולה כבן לוויה אינטראקטיבי: הוא "רואה" את המסך, מבין הוראות בשפה טבעית, ופועל דרך מקלדת ועכבר רגילים.

SIMA 2 מופעל על ידי ג'מיני

הגרסה השנייה, SIMA 2, מונעת על ידי מודלי החזית של ג'מיני (Gemini) ומאפשרת שיחה והנמקה בזמן אמת. לפי דיפמיינד, הסוכן מגיע לרמת משחק אנושית בסביבות תלת-ממד מורכבות ובמשחקים כמו No Man's Sky, Valheim ו-Hydroneer. עבור מפתחים, המשמעות היא יכולות AI שעובדות עם משחקים קיימים בלי שינוי שורת קוד אחת, מה שפותח אפשרויות לחוויות משחק חדשות לגמרי, מבני לוויה חכמים ועד מכניקות שלא היו אפשריות קודם.

השלכות מעבר לגיימינג

הרוח החוקרת שהניעה את הפריצות במשחקים זלגה לתחומים אחרים: אלפא-פולד (AlphaFold) יישמה את אותם יסודות כדי לפתור את אתגר חיזוי מבנה החלבונים בן חמישים השנים, הישג שזיכה את הצוות בפרס נובל לכימיה לשנת 2024. דיפמיינד מציגה את הרצף הזה כהוכחה שמשחקים אינם רק בנצ'מרק נוח, אלא מנוע שמייצר יכולות כלליות שמתגלגלות למדע יישומי.

מקור: deepmind.google