21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
מוצרים

אלכסנדר וואנג מכריז על גרסת מקס למודל Muse Spark 1.3

אלכסנדר וואנג מכריז על גרסת מקס למודל Muse Spark 1.3

אלכסנדר וואנג (Alexandr Wang) פרסם ב-X כי החברה שחררה לציבור את Muse Spark 1.3 max, גרסה חדשה שלדבריה מציגה שיפור משמעותי ביכולות קידוד ובביצועים סוכניים (agentic) בהשוואה לגרסאות הקודמות בסדרה. וואנג המליץ לנסות את הגרסה החדשה גם למי שכבר התנסו בגרסאות 1.3 high ו-1.3 xhigh.

התקדמות הגרסאות

ההודעה חושפת מסלול שחרור מדורג בתוך אותה משפחת מודל: תחילה הגיעו high ו-xhigh, ועכשיו מצטרפת גרסת max שממוצבת כמתקדמת מבין השלוש. החברה לא פירטה מה מבדיל טכנית בין הרמות, האם מדובר בגודל שונה, באימון ממושך יותר, או בכוונון (fine-tuning) ייעודי, והסתפקה בהצהרה כללית על "ביצועים חזקים משמעותית".

טענות ביצועים ללא מדדים

הטענה המרכזית נוגעת לשני תחומים: כתיבת קוד והפעלה סוכנית, כלומר יכולת המודל לתכנן ולבצע רצף פעולות עצמאי להשלמת משימה. אלא שההודעה לא מלווה במספרי בנצ'מרק (benchmarks), בשמות מבחנים ספציפיים (כמו HumanEval, SWE-bench או Arc), ולא בבסיס השוואה כמותי מול הגרסאות הקודמות. בהיעדר נתונים, מדובר בהצהרת יצרן בלבד.

זמינות והמלצת שימוש

וואנג הדגיש שהגרסה זמינה כעת לציבור וקרא למשתמשים לבדוק אותה בעצמם, גם אם כבר בחנו את האחיות הקטנות במשפחה. פרטים טכניים על אופן הגישה, API, ממשק צ'אט, משקולות פתוחות (open weights) או הרשאה מסחרית, לא נמסרו בפוסט.

מה חסר בתמונה

ההודעה קצרה ואינה כוללת תאריך אימון (knowledge cutoff), מגבלות ידועות, חלון הקשר (context window), או מדיניות תמחור. גם לא צוין אם הגרסה עברה הערכת בטיחות (safety evaluation) חיצונית או פנימית. עבור מפתחים שבונים על המודל בפרודקשן, פערי המידע האלה משמעותיים לא פחות מהשיפור המוצהר.