Muse Spark 1.3 (xHigh) נכנס לעשירייה הראשונה ב-Code Arena: WebDev

המודל החדש של AI at Meta, Muse Spark 1.3 בגרסת xHigh, הגיע למקום העשירי בטבלת Code Arena לקטגוריית WebDev עם ציון של 1,623 נקודות במדד AutoEval. התוצאה מציבה אותו צמוד ל-Claude Fable 5 שבמקום השמיני (1,628 נקודות) ול-GPT-5.6 Sol שבמקום ה-11 (1,616 נקודות).
קפיצה משמעותית מגרסאות קודמות
השיפור ביחס לדורות הקודמים בולט: Muse Spark 1.1 דורג במקום ה-25 עם 1,540 נקודות, וגרסת 1.2 (xHigh) הגיעה רק למקום ה-30 עם 1,534 נקודות. הפער של כ-80-90 נקודות מול הגרסאות הקודמות מעיד על התקדמות מהירה יחסית בפרק זמן קצר.
סייג חשוב: ציון AutoEval מוקדם
ראוי לציין שהציון הנוכחי מבוסס על AutoEval, מנגנון שבו מודל תגמול (Reward Model) שפותח על נתוני העדפה אנושיים של הזירה מטיל הצבעות אוטומטיות במקום מצביעים חיים. ב-AI at Meta מציינים שהציונים צפויים להשתנות ככל שיצטברו יותר הצבעות אנושיות אמיתיות.
יכולות מוצהרות: אופק ארוך ושיתוף פעולה
לפי הודעת השחרור, הגרסה החדשה מתמקדת בשימושיות בעולם האמיתי ומציגה שתי יכולות עיקריות: שמירה על עבודה ארוכת-אופק (longer-horizon) על פני מספר זרימות עבודה (workflows) בשרשור (thread) יחיד, ושיתוף פעולה אקטיבי יותר עם המשתמש, המודל שואל שאלות הבהרה במקום להניח הנחות.
הקשר תחרותי
הכניסה לעשירייה הראשונה מציבה את Meta בעמדה תחרותית מול המודלים המובילים של Anthropic ו-OpenAI בקטגוריית פיתוח ווב. אלכסנדר וואנג (Alexandr Wang), שמוביל את הצוות, זכה לברכות מהקהילה על השחרור.