NVIDIA פותחת את המודל הכי גדול לרכב אוטונומי, והפעם הוא גם מסביר את עצמו

Alpamayo 2 Super היא מודל VLA (Vision-Language-Action) בן 34 מיליארד פרמטרים שמקבל קלט ממצלמות קדמיות, צידיות ואחוריות, מתאחד אותן לתמונה פנורמית של 360 מעלות ומחשב מסלול נסיעה. NVIDIA הציגה אותו לראשונה בכנס GTC בטאיפיי בתחילת יוני, אבל רק עכשיו שחררה גישה אליו. המודל בנוי על בסיס Cosmos 3 Super Reasoner, ואחרי האימון הראשוני עבר reinforcement learning (RL) על תוצאות ההחלטות שלו עצמו בנסיעות מדומות.
לא רק נוהג, גם מצדיק
ההימור של NVIDIA הוא על המקרים הקשים, אלה שבהם רכב אוטונומי מתקשה הכי הרבה: החלפת נתיב, פנייה שמצריכה חציית תנועה נגדית וצמתים עמוסים. חוץ מהמסלול עצמו, המודל מפיק גם הסבר טקסטואלי לכל תמרון, כך שמפתח שמפעיל את המערכת יכול לראות איזה פרט בתמונה הוביל להחלטה הספציפית. NVIDIA מקשרת את היכולת הזאת לתקן הבטיחות ISO/PAS 8800, ומציעה להשתמש באותו מנגנון גם לתיוג אוטומטי של וידאו מרכבי מבחן, עבודה שלרוב לוקחת חודשים של הערכה ידנית.
המספרים בבנצ'מרק
במבחן LingoQA, שבודק יכולת של מערכת להסביר מצב דרך, NVIDIA מדרגת את Alpamayo 2 Super במקום הראשון. לפי נתוני החברה, המודל מקדים את Qwen2.5-VL 72B ב-17 נקודות ואת Gemini 2.5 Pro בכ-15 נקודות. אלו נתונים שהחברה מדווחת בעצמה, ואין להם כרגע אימות חיצוני.
רישיון ופריסה
הרישיון של המודל הוא Open MDW 1.1, והוא מאפשר כיוונון עדין (fine-tuning) על נתונים פרטיים והטמעה ברכבי ייצור. כלומר, מי שרוצה לקחת את Alpamayo 2 Super, לאמן אותו על הקטעים שלו ולשים אותו במכונית שיורדת מפס הייצור, יכול לעשות את זה תחת התנאים של הרישיון. הקוד והמודל זמינים ב-GitHub ובבלוג הרשמי של NVIDIA.