21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
מודלים

Muse Spark 1.3 של מטא נוחת ב-OpenRouter עם דגש על סוכנים ארוכי-טווח

Muse Spark 1.3 של מטא נוחת ב-OpenRouter עם דגש על סוכנים ארוכי-טווח

מודל חשיבה מולטי-מודלי לעבודה סוכנית ממושכת

Muse Spark 1.3 זמין החל מאתמול ב-OpenRouter, מודל חשיבה מולטי-מודלי שמטא פיתחה במיוחד לזרימות עבודה סוכניות (agentic), מרובות-סוכנים וקוד שדורשות ריצה ממושכת. המודל יודע לעקוב אחר מידע שנצבר לאורך משימה ארוכה, לטפל בקלטים סותרים שעולים תוך כדי תנועה, ולבקש הבהרה או אישור מהמשתמש כשהוא מזהה עמימות, כשהדגש המוצהר הוא על ביצוע תמציתי בלי עודף מלל.

אודיו עדיין לא שם, וזה כתוב באותיות קטנות

הבנת אודיו בגרסה 1.3 אינה נתמכת במלואה, ובמטא מציינים במפורש שאיכות התגובה עלולה להיפגע בבקשות שכוללות תוכן קולי. זו מגבלה שכדאי להביא בחשבון לפני שבונים על המודל לפיצ'רים שמשלבים קול; בשלב זה הוא מכוון לטקסט וראייה בלבד.

תמחור וקונטקסט: מיליון טוקנים ב-1.25 דולר לקלט

המודל מציע חלון קונטקסט של מיליון טוקנים בתמחור של 1.25 דולר למיליון טוקני קלט (כ-4.6 שקל) ו-4.25 דולר למיליון טוקני פלט (כ-15.6 שקל). המספרים ממקמים אותו בטווח הביניים של מודלי חשיבה גדולים, זול יותר מהדגמים היקרים של OpenAI ו-Anthropic, יקר יותר ממודלים פתוחים שרצים מקומית.

ביצועים: 81 טוקן לשנייה, 3.23 שניות זמן אחזור

בנצ'מרק ה-P50 של OpenRouter מראה תפוקה של 81 טוקן לשנייה וזמן אחזור חציוני של 3.23 שניות אצל הספק המהיר ביותר. הנתונים האלה משקפים את הביצועים הטובים ביותר שנמדדו בין הספקים השונים שמריצים את המודל בפלטפורמה; בפועל המספרים עשויים להשתנות בהתאם לנתיב הניתוב שנבחר.

ניתוב אוטומטי וזמינות גבוהה דרך ה-API

OpenRouter מדווחת על זמינות של 99.97% ו-84.83% (שני מדדים נפרדים שהפלטפורמה מפרסמת), ומאפשרת ניתוב אוטומטי לספק בריא כשמתרחשת שגיאה אצל הספק הראשי, בתנאי שהגדרות הבקשה מאפשרות זאת. נתוני זמינות פר-ספק נגישים דרך ה-Endpoints API למי שרוצה לבנות לוגיקת fallback משלו.