21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
מוצרים

דיפסיק משיקה גרסת ראייה ניסיונית למודל הפלאש, זמינה כבר עכשיו ב-OpenRouter

דיפסיק משיקה גרסת ראייה ניסיונית למודל הפלאש, זמינה כבר עכשיו ב-OpenRouter

המודל החדש, DeepSeek V4 Flash Vision Exp, מוסיף יכולת עיבוד תמונה למודל הפלאש הקיים בלי לשנות את התמחור: 0.22 דולר למיליון טוקנים בכניסה ו-0.66 דולר ביציאה (כ-0.81 ו-2.44 שקל בהתאמה). מדובר בגרסה ניסיונית (Exp) של V4 Flash 0731, שמגיעה עם חלון הקשר של מיליון טוקנים וזמינה מיידית דרך ה-API של OpenRouter.

ארכיטקטורת MoE דלילה, 13B פעילים מתוך 284B

מתחת למכסה המנוע יושב מודל mixture-of-experts דליל עם 284 מיליארד פרמטרים בסך הכל, שמתוכם רק 13 מיליארד פעילים בכל העברה קדימה (forward pass). הארכיטקטורה הזו מאפשרת לשמור על עלות נמוכה ומהירות גבוהה בזמן שהיכולות המולטי-מודאליות מתווספות על גבי הבסיס הטקסטואלי הקיים. דיפסיק מגדירה את המודל כמתאים להבנת מסמכים ותרשימים, מענה ויזואלי (VQA) ותהליכי סוכן (agent) שמשלבים טקסט ותמונה לסירוגין.

בנצ'מרקים: משתווה לבסיס בטקסט, עוקף את Opus-4.8 בשני מבחני סוכנים

לפי נתוני היצרן, המודל החדש משתווה ל-V4 Flash 0731 בבנצ'מרקים של סוכנים טקסטואליים, חשיבה וידע עולם. היתרון המוצהר מגיע בשני מבחנים ספציפיים: Agents' Last Exam ו-ZeroBench, שם הוא מדווח כניצחון על Claude Opus-4.8. חשוב לסייג: מדובר בנתוני יצרן בלבד, בלי אימות עצמאי או הרצת מבחנים בתנאים זהים על ידי צד שלישי. המודל מסומן כ-Experimental, מה שאומר שגרסה יציבה עשויה לשנות התנהגות או ביצועים.

ביצועים ברשת: 113 טוקן/שנייה, השהייה של 1.03 שניות

OpenRouter מדווח על תפוקה חציונית (P50) של 113 טוקנים לשנייה והשהייה חציונית של 1.03 שניות, הנתונים הטובים ביותר בין הספקים שמריצים את המודל. זמינות (uptime) של 100% ו-99.96% בשני מדדים שונים, עם מנגנון ניתוב אוטומטי לספק חלופי כשמתרחשת שגיאה אצל ספק עליון. הנתונים האלה משקפים את תשתית ההרצה של OpenRouter, לא את המודל כשלעצמו, והם רלוונטיים רק למי שצורך את השירות דרכם.

מה חסר בתמונה, ואיפה זה משאיר מפתחים

אין עדיין דוח טכני, אין משקלים פתוחים, ואין תוצאות על מבחני ראייה סטנדרטיים כמו MMMU או MathVista. התמחור זהה למודל הטקסט בלבד, מה שהופך את הניסיון לזול יחסית, אבל היעדר בנצ'מרקים עצמאיים פירושו שכל שילוב בייצור (production) כרגע הוא הימור מחושב. עבור מי שכבר בונה על OpenRouter ורוצה לבדוק מולטי-מודאליות בלי להחליף ספק, זו נקודת כניסה נוחה. השאר יחכו לגרסה הלא-ניסיונית ולנתונים בלתי תלויים.