דיפסיק משיקה את V4.1-פלאש וקופצת למקום 14 בזירת הקוד עם תמחור שובר שוק

המודל החדש של דיפסיק (DeepSeek) נחת היישר למקום ה-14 בדירוג Code Arena לקטגוריית WebDev עם ציון של 1,620 נקודות בבדיקת AutoEval, ומציב את עצמו כמודל הפתוח הרביעי בטיבו, רק 11 נקודות מתחת ל-Qwen3.8-Flash-Next. השיפור מול הדור הקודם חד: תוספת של 38 נקודות מול V4-Flash (High) שבמקום 20, ו-40 נקודות מול V4-Pro (High) שבמקום 21.
פער של חמש נקודות מהצמרת
המודל החדש יושב כעת במרחק של חמש נקודות בלבד מהמודלים שבמקומות 11 עד 13, אבל התמונה המעניינת יותר נמצאת בעמודת המחיר. דיפסיק גובה 30 סנט למיליון טוקני קלט ו-1.20 דולר למיליון טוקני פלט (כ-1.1 שקל ו-4.4 שקל בהתאמה). לשם השוואה, Hy4 Preview שבמקום 13 עולה 83 סנט ו-2.50 דולר (כ-3 ו-9.2 שקל), Grok-4.6 High שבמקום 12 גובה 2 דולר ו-6 דולר (כ-7.4 ו-22 שקל), ו-Muse Spark 1.3 xHigh שבמקום 11 מתומחר ב-1.25 דולר ו-4.25 דולר (כ-4.6 ו-15.7 שקל). הפער בעלויות מגיע לפי שישה עד עשרה לטובת המודל הסיני.
אוטו-איוול: ציון מוקדם עם כוכבית
חשוב להדגיש: הציון הנוכחי מגיע מבדיקת AutoEval מוקדמת, שבה מודל תגמול (Reward Model) שפותח על נתוני העדפה אנושיים של הזירה מצביע אוטומטית במקום בוחרים חיים. בדיפסיק ובזירה מציינים שהציונים צפויים להשתנות ככל שיצטברו יותר הצבעות אנושיות אמיתיות, תזכורת שבדיקות אוטומטיות, גם כשהן מבוססות על העדפות אנוש, אינן תחליף מלא להערכה חיה.
ארכיטקטורה חדשה: קטן, רואה, מהיר
לפי הודעת החברה, V4.1-פלאש הוא המודל הקטן ביותר במשפחת ארכיטקטורה חדשה, והוא הראשון שכולל הבנה חזותית מובנית (native visual understanding). בדיפסיק מכוונים ליכולת גבוהה יותר, הסקה מהירה יותר, תפוקה (throughput) גבוהה יותר, ויכולת קנה מידה למודלים גדולים יותר בהמשך. במילים אחרות: זהו אב-טיפוס לקו מוצרים רחב יותר שעוד יגיע.
תרומה לאקוסיסטם הפתוח, עם הסתייגות
ההודעה הרשמית מברכת על "תרומה לאקוסיסטם של קוד פתוח", אלא שהמונח דורש דיוק: משקלים פתוחים (open weights) אינם קוד פתוח במובן המלא, הקוד, נתוני האימון ותהליך הפיתוח אינם בהכרח זמינים. עדיין, זמינות המשקלים מאפשרת למפתחים להריץ, לכוונן ולשלב את המודל בלי תלות ב-API סגור, וזה כשלעצמו משנה את כללי המשחק עבור צוותים שרוצים שליטה מלאה בעלויות ובפרטיות.