27 בספטמבר 2026 האקדמיה ארכיון
מבזקים
סוכני OpenAI הריצו 16 אלף בקשות לאתר האו"ם בניסיון לעקוף מגבלות גישה סין התקינה יותר רובוטים תעשייתיים ב-2025 משאר העולם יחד מאמר חדש מציע מפת דרכים לשיפור עצמי רקורסיבי של בינה מלאכותית מודל 340 מיליון פרמטרים רץ על GPU של טלפון, עם זהות מספרית למודל הייחוס גוגל בודקת רכישה ישירה מפליפקארט דרך ג'מיני ו-AI Mode בהודו
מודלים

עליבאבא משיקה את Qwen3.8-Max עם 2.4 טריליון פרמטרים ותמחור שובר שוק

עליבאבא משיקה את Qwen3.8-Max עם 2.4 טריליון פרמטרים ותמחור שובר שוק

ענקית הטכנולוגיה הסינית Alibaba שחררה את Qwen3.8-Max, מודל שפה ענק של 2.4 טריליון פרמטרים שמפעיל רק כ-95 מיליארד פרמטרים לכל טוקן בזכות ארכיטקטורת mixture-of-experts דלילה. הנתב הקטן בוחר קומץ מומחים לכל העברה קדימה, מה שמאפשר תמחור אגרסיבי של 2 דולר למיליון טוקני קלט ו-6 דולר למיליון טוקני פלט (כ-7.4 ו-22 שקל בהתאמה), מחיר שמציב אותו על חזית ה-Pareto של עלות-ביצועים ב-Frontend Code Arena לצד Claude Opus 5, Kimi K3, GLM-5.2 ו-DeepSeek-V4-Flash.

מיקום בצמרת הקוד

ב-Frontend Code Arena השיג Qwen3.8-Max ניקוד של 1,668 נקודות, שממקם אותו במקום הרביעי, צמוד ל-Claude Opus 5 (High) עם 1,669 נקודות, ומאחורי Kimi K3 (Max) עם 1,676 ו-Claude Opus 5 (Max) שמוביל עם 1,705. הפער מהפסגה צנוע, והמודל הסיני מוכיח שהוא מסוגל להתחרות ראש בראש עם המודלים היקרים ביותר בשוק המערבי בלי לדרוש תקציבי עתק.

יכולות מולטימודליות ורכיב אוטונומי

ב-Vision Arena, שבוחן חשיבה מולטימודלית על תמונות, כיתוב, OCR, דיאגרמות וזיהוי ישויות, נכנס המודל למקום השני עם 1,305 נקודות. הוא מפגר ב-13 נקודות בלבד אחרי Claude Fable 5, ומקדים ב-2 נקודות את Claude Opus 4.7 (Thinking). מעבר לבנצ'מארקים, Qwen3.8-Max השלים ריצת קוד אוטונומית של יותר מעשרה ימים שבה בנה מאפס את ה-harness המתפתח oh-my-cli, כולל בנייה, בדיקה, אימות ותיקון עצמאיים של המערכת.

מבחן מעשי: פלפי בירד בעשירית המחיר

במבחן צד-אל-צד של יצירת משחק Flappy Bird ב-one-shot, קיבל Qwen3.8-Max ציון 9 מתוך 10 בגיימפליי, UI ו-UX, זהה ל-GPT-5.6 Sol, בעלות של 0.0248 דולר בלבד (כ-9 אגורות). זה בערך פי 4.2 זול מהמתחרים שהשיגו תוצאה דומה. השילוב בין ביצועי קצה לעלות שולית נמוכה הופך את המודל לאופציה מעשית לצוותי פיתוח שצריכים להריץ כמויות גדולות של קוד בלי לשבור את התקציב.