7 באוקטובר 2026 האקדמיה ארכיון
מבזקים
טוני פאדל: גל ראשון של מכשירי בינה מלאכותית נכשל כי לא פתרו בעיה אמיתית הלת'ליפ (Healthleap) גייסה 38 מיליון דולר כדי לאתר חולים שהתיק הרפואי שלהם מסתיר סיכון לא מאובחן ליקוויד משיקה מודלי החלטה מולטימודליים לקצה, d1-3B מוביל את מדד ההחלטות מתחת ל-10 מיליארד פרמטרים Common Sense Media: ChatGPT לבני נוער, "סיכון בלתי קביל" הארק משיקה עוזר אישי שמתמקד בפרטיות ומנסה להחליף את המחשב
מודלים

מיסטרל לארג' 4 נוחת באופן-ראוטר: טריליון פרמטרים, 49 מיליארד פעילים

מיסטרל לארג' 4 נוחת באופן-ראוטר: טריליון פרמטרים, 49 מיליארד פעילים

Mistral השיקה את לארג' 4, שזכה לכינוי הפנימי "לה שונק" (Le Chonk), בגרסת תצוגה מקדימה ציבורית בפלטפורמת באופן-ראוטר (OpenRouter). המודל החדש מציג ארכיטקטורת מיקסצ'ר-אוף-אקספרטס (Mixture-of-Experts) עם טריליון פרמטרים כוללים, מהם 49 מיליארד פעילים בכל העברה קדימה (forward pass), והוא הראשון של החברה שתוכנן מראש כמולטי-מודאלי (natively multimodal). חלון ההקשר מגיע למיליון טוקנים, ואורך הפלט המרבי עומד על 256 אלף טוקנים, קפיצה משמעותית מול הדור הקודם.

ארכיטקטורה ומפרט טכני

הבחירה ב-MoE עם 49 מיליארד פרמטרים פעילים ממקמת את לארג' 4 בטריטוריה דומה ל-GPT-4o ול-Claude 3.5 סונט (Sonnet) מבחינת תקציב חישוב בזמן הסקה, אבל עם מאגר ידע רחב בהרבה בזכות הפרמטרים הרדומים. המודל תומך בטקסט, תמונה ואודיו כקלט, ומפיק טקסט בלבד בשלב זה. באופן-ראוטר מדווחים על זמינות מיידית דרך ה-API, אם כי מדובר בגרסת preview, כלומר שינויים שוברים (breaking changes) עדיין אפשריים לפני השקה כללית (GA).

תמחור: הנחת השקה לשבועיים ראשונים

במהלך השבועיים הראשונים מציעה באופן-ראוטר 50% הנחה: 0.68 דולר למיליון טוקני קלט (כ-2.5 שקל) ו-2.09 דולר למיליון טוקני פלט (כ-7.7 שקל). טוקנים במטמון (cached) מתומחרים ב-0.07 דולר למיליון (כ-0.26 שקל). אחרי תקופת ההנחה המחירים צפויים לעלות ל-1.36 ו-4.18 דולר בהתאמה, עדיין תחרותי מול מודלים סגורים מקבילים, אבל יקר יותר ממודלים פתוחים-משקלים (open-weights) שמריצים לוקאלית.

טענות ביצועים: "הטוב ביותר מארה"ב או אירופה", בלי נתונים גלויים

לפי ההודעה, לארג' 4 הוא "מודל המשקולות-הפתוחות (open-weights) הטוב ביותר מארה"ב או מאירופה במבחנים מצרפיים (aggregated benchmarks)", והוא מגיע ל-state-of-the-art בעומסי עבודה קריטיים: הגנת סייבר, ייצור ופיננסים. אלא שההודעה לא מפרסמת ציונים קונקרטיים, לא מציינת באילו בנצ'מרקים מדובר (MMLU? GPQA? SWE-bench?), ולא מספקת השוואה מספרית מול לאמה 3.1 405B, נמוטרון 3 אולטרה (Nemotron 3 Ultra) או קיוואן 2.5 72B. בלי נתונים גלויים ושחזור עצמאי, הטענות נשארות בגדר הצהרת יצרן, לא מדידה.

מה זה אומר למפתחים כרגע

הזמינות המיידית באופנ-ראוטר מאפשרת לנסות את המודל בלי להרים תשתית GPU משלך, וחלון המיליון-טוקן פותח אפשרויות ל-RAG בקנה מידה גדול, ניתוח קודבייסים שלמים, או עיבוד מסמכים ארוכים בפרומפט יחיד. מגבלת 256 אלף טוקני פלט שימושית במיוחד לייצור קוד ארוך, דוחות מפורטים, או תרגום מסמכים שלמים. מצד שני, preview פירושו שינויים אפשריים ב-API, בלאטנסי (latency) ובהתנהגות המודל, לא משהו שבונים עליו פרודקשן קריטי בלי fallback.

שורה תחתונה: לחכות להערכות בלתי תלויות

מיסטרל מספקת מודל מרשים על הנייר, MoE בקנה מידה גדול, מולטי-מודאליות ילידית, חלון הקשר עצום, והמחיר בהשקה אטרקטיבי. אבל בהיעדר בנצ'מרקים מפורטים, הערכות צד שלישי, או השוואה הוגנת מול המתחרים הפתוחים-משקלים הקיימים, מוקדם לקבוע אם "לה שונק" באמת מחליף את המלך הנוכחי. בינתיים: אפשר לשחק, לבדוק על משימות ספציפיות שלכם, ולראות אם ה-49B הפעילים מספקים את הסחורה.