ספייס-אקס-איי משיקה את גרוק 4.7: מודל בסיס גדול יותר באותו תמחור של 4.6

מודל דגל חדש בלי העלאת מחיר
ספייס-אקס-איי (SpaceXAI) שחררה את גרוק 4.7, מודל הדגל החדש שלה לקודינג, משימות סוכניות (agentic) ועבודת ידע. השינוי המרכזי: מודל בסיס (base model) גדול יותר וריצת חיזוק (RL) ארוכה יותר על משימות קשות, אבל התמחור נשאר זהה, 2 דולר למיליון טוקני קלט ו-6 דולר למיליון טוקני פלט (כ-7.4 ו-22 שקל בהתאמה). המודל זמין כבר עכשיו דרך ה-API של xAI, קורסור (Cursor), גרוק בילד (Grok Build), אופן-ראוטר (OpenRouter), ורסל (Vercel) וקלאודפלייר (Cloudflare).
מה השתנה מתחת למכסה המנוע
לפי מסמכי המפתחים, ארבעה שינויים עיקריים מבדילים את 4.7 מקודמו: מודל בסיס חדש לגמרי (לא שימוש חוזר בבסיס של 4.6), ריצת RL ממושכת על משימות שלוקחות שעות ארוכות להשלמה, שיפור ב-self-verification ובטיפול בקונטקסט ארוך, ואימון ייעודי להבנת ה-Grok Bot harness לשיחות ועבודת ידע. חלון הקונטקסט עומד על 500 אלף טוקנים, וה-API מציע ארבע רמות מאמץ (reasoning levels) עד xHigh.
בנצ'מרקים: קפיצה מול 4.6, תמונה מעורבת מול המתחרים
בטבלת ההשקה גרוק 4.7 משפר את 4.6 בכל שורה. הזינוק הגדול ביותר בטרמינל-בנץ' (Terminal-Bench) 4.0, מ-20.3% ל-38.0%. ב-EEBench הגיע ל-64.0%, התוצאה הגבוהה בטבלה. בהארווי (Harvey), בנצ'מרק סוכן משפטי, השיג 19.6% מול 6.7% של פייבל 5.1 מקס (Fable 5.1 Max). אלא שההובלה לא מוחלטת: פייבל 5.1 מקס מוביל בארבעה מתוך שבעה מבחנים, כולל 57.9% בטרמינל-בנץ', ו-GPT-5.6 סול מקס (GPT-5.6 Sol Max) מחזיק בתוצאת DeepSWE v1.1 הטובה ביותר, 72.7%. כל הציונים הם vendor-reported, כלומר דווחו על ידי החברה עצמה בלי אימות חיצוני.
ציר המחיר: יתרון ב-price-performance
כאן נכנס היתרון התחרותי המרכזי. פייבל 5.1 מקס יקר פי 5 בקלט וכ-8.3 פעמים בפלט. GPT-5.6 סול מקס יקר פי 2 בקלט וכ-3.3 פעמים בפלט. בגרף CursorBench 4.0 של cost-per-task, ספייס-אקס-איי ממקמת את גרוק 4.7 בחזית ה-price-performance. ב-GDPval, שבוחן עבודת ידע מקצועית, גרוק 4.7 xHigh השיג 1,695 אלואו (Elo), עלייה מ-1,605 של 4.6 High. פייבל 5.1 מקס מוביל עם 1,735, ו-GPT-6 אסטרה מקס (GPT-6 Astra max) עומד על 1,542. בחברה מציינים גם שיפור ביצירת מסמכים ומצגות.
אבטחה: סט הגנות חדש, גישה מוגבלת ל-red-teaming
גרוק 4.7 מגיע עם סט הגנות (safeguard stack) חדש לגמרי. בספייס-אקס-איי מגדירים אותו כמודל החזק ביותר שבדקו בסירובים (refusals) ועמידות לג'יילברייק (jailbreak). בלצ'-ביו (LatchBio) ביוסייפטי (biosafety) הגיע ל-62.4%. בהאקר-בנץ' (HackerBench) v0.3, בנצ'מרק פנימי למשימות סייבר מסוכנות, המודל איפשר מעבר של 3.3% מהפרומפטים הבעייתיים הדואליים; בחברה טוענים שהוא כמעט לא חוסם עבודת אבטחה לגיטימית. שותפי סייבר נבחרים מקבלים גישה בהזמנה בלבד ליכולות רד-טים (red-team) למחקר הגנתי.
תמחור וזמינות: גרסה מהירה, אנדפוינט אזורי, מטמון
גרוק 4.7 פאסט (Fast) הוא אותו מודל על תשתית מהירה יותר, פי 2 מהירות פלט במחיר כפול. הוא רץ רק בקורסור ובגרוק בילד, לא ב-API הציבורי, ומוחרג מהטיר החינמי של גרוק בילד. אנדפוינט אזורי בארה"ב שומר את האינפרנס (inference) בגבולות המדינה בתוספת 10% פרמיה. בספייס-אקס-איי ממליצים להגדיר prompt_cache_key לפגיעות מטמון (cache hits) אמינות.