1 באוקטובר 2026 האקדמיה ארכיון
מבזקים
גוגל משיקה את Gemini 4 Argon עם מיליון טוקני פלט Voyage AI משיקה ריראנקרים חדשים ומודל מולטימודלי ב-OpenRouter OpenAI משיקה את Dots, סוכנים אוטונומיים למנויי פרו בלבד טראמפ מכריז על "סופר אינטליג'נס" ומחליף רגולציה בהתחייבות מוסרית של ששת הגדולים אילבן לאבס מכפילה שווי ל־22 מיליארד דולר בהצעת רכש לעובדים
מודלים

גוגל משיקה את Gemini 4 Argon עם מיליון טוקני פלט

גוגל משיקה את Gemini 4 Argon עם מיליון טוקני פלט

גוגל דיפמיינד חשפה את Gemini 4 Argon, הדגם הראשון בדור הרביעי של ג'מיני, שמהמר בגדול על אורך פלט חסר תקדים: מיליון טוקנים בתשובה בודדת, פי 16 מהמגבלה הקודמת של 64 אלף. הדגם מכוון לשלושה תרחישי שימוש עיקריים, הנדסת תוכנה באופק ארוך, עבודת ידע ארגונית במשפט ופיננסים, והגנת סייבר, ומושק בגישה מדורגת שכוללת הליך וולונטרי של הממשל האמריקאי לגישה מוקדמת לפני הפצה רחבה.

חלון פלט של מיליון טוקנים ותמחור אגרסיבי

הקפיצה ל-1M טוקני פלט מציבה את Argon הרחק מעבר למתחרים המיידיים: Claude Opus 5.5, Claude Fable 5.1 ו-GPT-6 Astra נעצרים ב-128 אלף טוקנים בלבד. בגוגל טוענים שהיכולת "לחשוב לעומק" ולפלוט מאות אלפי טוקנים בריצה אחת מאפשרת ריפקטורינג נרחב או דוחות ארוכים בלי לפצל את העבודה למספר סבבים. התמחור בפתיחה עומד על 2 דולר למיליון טוקני קלט (כ-7.3 שקלים) ו-10 דולר למיליון טוקני פלט (כ-36.5 שקלים); טוקני קלט במטמון (Cached) מקבלים הנחה של 95% ויורדים ל-10 סנט למיליון (כ-36 אגורות). אחרי תקופת ההשקה המחירים מכפילים את עצמם ל-4 ו-20 דולר בהתאמה. לוגן קילפטריק (Logan Kilpatrick) אישר את המספרים. גוגל לא חשפה עדיין את גודל חלון הקלט של הדגם.

בנצ'מרקים: מוביל בהנדסה ארוכה ומשפט, מפגר בשימוש במחשב

בהשוואה פנימית מול שלושת המתחרים הנ"ל, Argon מוביל ב-12 מתוך 18 מבחנים ומשווה מקום ראשון באחד נוסף. הניצחונות הבולטים: DeepSWE v1.1 (הנדסת תוכנה ארוכת־אופק) עם 77.9%, שיא מצב הידע (SOTA) חדש מול 74.2% של Opus 5.5 ו-74.1% של GPT-6 Astra; Vals Index (השפעה כלכלית בפיננסים, קוד, משפט ומיסוי) 68.9%; AutomationBench (ביצוע עסקי מקצה לקצה בזאפייר) 51.3% מול 42.5% של Opus 5.5; Harvey Legal Agent Benchmark עם 19.6% מול 5.4% בלבד של GPT-6 Astra; ו-LVBench (הבנת וידאו ארוך) 91.7%, גם כאן SOTA. מנגד, Argon מפגר ב-FrontierSWE v2 (55% מול 65.5% של GPT-6 Astra), Terminal-Bench 4.0 (57.4% מול 66.4% של Opus 5.5) ו-OSWorld-2.0 (שימוש במחשב, 69.2% מול 72.6%). ניתוח של Artificial Analysis הראה ש-Argon משווה את GPT-6 Astra במדד האינטליגנציה שלהם ב-60% מהעלות למשימה, לפי מחירי ההנחה.

הגנת סייבר אוטונומית ושימוש פנימי בהיקף פטה־בייט

גוגל אימנה את Argon לאתר, לאמת ולתקן חולשות קריטיות באופן אוטונומי; מגנים מורשים וצוותים פנימיים מקבלים גרסה ללא גדרות סייבר. ב-CWE-bench v1, שבוחן תיקון פגיעויות, הדגם משווה מקום ראשון עם 68%, כשהמתחרים רצים בתוך מסגרות סוכן (Agent Harnesses) משלהם. Wiz כבר משתמשת במודל במסגרת יוזמת Scan for Good, ודיווחה שהוא איתר חולשה קריטית בתוכנת בריאות שבשימוש בתי חולים בעולם, שדגמי חזית קודמים פספסו. לפני הפצה רחבה גוגל מחזקת הגנות בארבעה תחומים: הגנות שימוש לרעה בסייבר ו-CBRN כולל ניטור הפעלה תחת מסגרת הבטיחות החזיתית; עמידות להזרקת פרומפט עקיפה (מוביל בבנצ'מרק IPI של Gray Swan); ניטור חוסר־יישור של שרשרת החשיבה והיכולת לעצור הרצה; וארגזי חול חתומים ומבודדים לאימונים והערכות בסיכון גבוה. בתוך גוגל אלפי עובדים כבר מריצים את Argon: סוכנים יישמו אופטימיזציות זיכרון בדאטה־סנטרים ושחררו מעל 300 טיבייב (TiB), עם תחזית ל-500 טיבייב עד 1 פיבייב (PiB); סוכנים נוספים החליפו 32 אלף שורות קוד, נתון שנחתך במקור.

מקור: marktechpost.com