Muse Spark 1.3 של מטא נוחת ב-OpenRouter עם דגש על סוכנים ארוכי-טווח

מודל חשיבה מולטי-מודלי לעבודה סוכנית ממושכת
Muse Spark 1.3 זמין החל מאתמול ב-OpenRouter, מודל חשיבה מולטי-מודלי שמטא פיתחה במיוחד לזרימות עבודה סוכניות (agentic), מרובות-סוכנים וקוד שדורשות ריצה ממושכת. המודל יודע לעקוב אחר מידע שנצבר לאורך משימה ארוכה, לטפל בקלטים סותרים שעולים תוך כדי תנועה, ולבקש הבהרה או אישור מהמשתמש כשהוא מזהה עמימות, כשהדגש המוצהר הוא על ביצוע תמציתי בלי עודף מלל.
אודיו עדיין לא שם, וזה כתוב באותיות קטנות
הבנת אודיו בגרסה 1.3 אינה נתמכת במלואה, ובמטא מציינים במפורש שאיכות התגובה עלולה להיפגע בבקשות שכוללות תוכן קולי. זו מגבלה שכדאי להביא בחשבון לפני שבונים על המודל לפיצ'רים שמשלבים קול; בשלב זה הוא מכוון לטקסט וראייה בלבד.
תמחור וקונטקסט: מיליון טוקנים ב-1.25 דולר לקלט
המודל מציע חלון קונטקסט של מיליון טוקנים בתמחור של 1.25 דולר למיליון טוקני קלט (כ-4.6 שקל) ו-4.25 דולר למיליון טוקני פלט (כ-15.6 שקל). המספרים ממקמים אותו בטווח הביניים של מודלי חשיבה גדולים, זול יותר מהדגמים היקרים של OpenAI ו-Anthropic, יקר יותר ממודלים פתוחים שרצים מקומית.
ביצועים: 81 טוקן לשנייה, 3.23 שניות זמן אחזור
בנצ'מרק ה-P50 של OpenRouter מראה תפוקה של 81 טוקן לשנייה וזמן אחזור חציוני של 3.23 שניות אצל הספק המהיר ביותר. הנתונים האלה משקפים את הביצועים הטובים ביותר שנמדדו בין הספקים השונים שמריצים את המודל בפלטפורמה; בפועל המספרים עשויים להשתנות בהתאם לנתיב הניתוב שנבחר.
ניתוב אוטומטי וזמינות גבוהה דרך ה-API
OpenRouter מדווחת על זמינות של 99.97% ו-84.83% (שני מדדים נפרדים שהפלטפורמה מפרסמת), ומאפשרת ניתוב אוטומטי לספק בריא כשמתרחשת שגיאה אצל הספק הראשי, בתנאי שהגדרות הבקשה מאפשרות זאת. נתוני זמינות פר-ספק נגישים דרך ה-Endpoints API למי שרוצה לבנות לוגיקת fallback משלו.