21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
מודלים

Muse Spark 1.3 (xHigh) נכנס לעשירייה הראשונה ב-Code Arena: WebDev

Muse Spark 1.3 (xHigh) נכנס לעשירייה הראשונה ב-Code Arena: WebDev

המודל החדש של AI at Meta, Muse Spark 1.3 בגרסת xHigh, הגיע למקום העשירי בטבלת Code Arena לקטגוריית WebDev עם ציון של 1,623 נקודות במדד AutoEval. התוצאה מציבה אותו צמוד ל-Claude Fable 5 שבמקום השמיני (1,628 נקודות) ול-GPT-5.6 Sol שבמקום ה-11 (1,616 נקודות).

קפיצה משמעותית מגרסאות קודמות

השיפור ביחס לדורות הקודמים בולט: Muse Spark 1.1 דורג במקום ה-25 עם 1,540 נקודות, וגרסת 1.2 (xHigh) הגיעה רק למקום ה-30 עם 1,534 נקודות. הפער של כ-80-90 נקודות מול הגרסאות הקודמות מעיד על התקדמות מהירה יחסית בפרק זמן קצר.

סייג חשוב: ציון AutoEval מוקדם

ראוי לציין שהציון הנוכחי מבוסס על AutoEval, מנגנון שבו מודל תגמול (Reward Model) שפותח על נתוני העדפה אנושיים של הזירה מטיל הצבעות אוטומטיות במקום מצביעים חיים. ב-AI at Meta מציינים שהציונים צפויים להשתנות ככל שיצטברו יותר הצבעות אנושיות אמיתיות.

יכולות מוצהרות: אופק ארוך ושיתוף פעולה

לפי הודעת השחרור, הגרסה החדשה מתמקדת בשימושיות בעולם האמיתי ומציגה שתי יכולות עיקריות: שמירה על עבודה ארוכת-אופק (longer-horizon) על פני מספר זרימות עבודה (workflows) בשרשור (thread) יחיד, ושיתוף פעולה אקטיבי יותר עם המשתמש, המודל שואל שאלות הבהרה במקום להניח הנחות.

הקשר תחרותי

הכניסה לעשירייה הראשונה מציבה את Meta בעמדה תחרותית מול המודלים המובילים של Anthropic ו-OpenAI בקטגוריית פיתוח ווב. אלכסנדר וואנג (Alexandr Wang), שמוביל את הצוות, זכה לברכות מהקהילה על השחרור.