21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
מוצרים

מיני-מקס M3 מגיע ל-59 אחוזים ב-SWE-Bench Pro ורץ הכי מהר על סמבה-קלאוד

מיני-מקס M3 מגיע ל-59 אחוזים ב-SWE-Bench Pro ורץ הכי מהר על סמבה-קלאוד

החברה הסינית מיני-מקס (MiniMax) השיקה את M3, מודל פתוח-משקלים שמכוון ישירות לסוכנים ארוכי-אופק ולמשימות הנדסת תוכנה מורכבות. המודל זמין כבר עכשיו למפתחים דרך סמבה-קלאוד (SambaCloud), שם הוא רץ מהר יותר מאשר בכל פלטפורמה אחרת, ומחליף את M2.7 כמודל החזק ביותר בפורטפוליו של החברה.

ארכיטקטורת קשב דלילה שפותחת חלון של מיליון טוקנים

החידוש המרכזי הוא MiniMax Sparse Attention (MSA), ארכיטקטורת קשב חדשה שמורידה את החישוב פר טוקן לאחד חלקי עשרים מהדור הקודם. התוצאה: חלון הקשר של מיליון טוקנים עם האצת פריפיל (prefill) של יותר מפי 9 והאצת דיקודינג (decoding) של יותר מפי 15, תוך שמירה על ביצועים דומים לקשב מלא ברוב היכולות. בפועל זה אומר שמאגרי קוד שלמים, מאמרים ארוכים ויומני הרצה של סוכנים על פני ימים נכנסים לחלון יחיד בלי לקצוץ.

תוצאות בנצ'מרק שמציבות אותו בליגה של המודלים הסגורים

בקידוד ובסוכנים M3 משיג 59.0% ב-SWE-Bench Pro, 66.0% ב-Terminal-Bench 2.1 ו-74.2% ב-MCP Atlas, ציונים שהופכים אותו לאחת האופציות החזקות ביותר בקטגוריית המשקלים הפתוחים. נוספו גם 34.8% ב-SWE-fficiency ו-28.8% ב-KernelBench Hard. במיני-מקס מדגישים שהאימון כלל סימולטור משתמש אינטראקטיבי שמדמה איך מפתחים אמיתיים משתפים פעולה, מבהירים דרישות, מתקנים פתרונות ומתארים בסבבים מרובים, כך שהמודל מתפקד כשותף פעיל ולא כמבצע הוראות פסיבי.

אוטונומיה של 24 שעות בלי התערבות אדם

במבחנים פנימיים של החברה, M3 רץ אוטונומית במשך כיממה שלמה כדי לייעל קרנל CUDA של FP8 GEMM. במהלך הריצה בוצעו 147 הגשות בנצ'מרק ו-1,959 קריאות כלי, וניצולת השיא של החומרה זינקה מ-7.6% ל-71.3%, שיפור של פי 9.4, ללא שום התערבות אנושית. בניסוי נוסף שחזר המודל באופן עצמאי את הניסויים המרכזיים של מאמר מצטיין של ICLR 2025, הפיק 18 קומיטים ו-23 איורים ניסויים לאורך כ-12 שעות.

מולטימודליות ילידית ולא מודבקת בדיעבד

M3 אומן על טקסט, תמונה ווידאו מהצעד הראשון (step 0), לא כשכבה שנוספה אחר כך. זה מאפשר לו לקרוא תרשימים, נוסחאות וצילומי מסך, ולהפעיל מחשב שולחני, יכולת שפותחת את הדלת לסוכני שימוש-במחשב (computer-use agents) ולזרימות עבודה מקצה לקצה על פני אפליקציות, קבצים ומערכות. במיני-מקס מציינים גם תוצאות חזקות בזרימות עבודה משרדיות אמיתיות כולל חיפוש, משימות אופיס ותזמור כלים, עם יכולת מתהווה בתחום הפיננסי.