21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
מודלים

אנבידיה מרחיבה את ורה רובין עם גרוק 3 LPX בייצור מלא, מציגה 3,400 טוקנים לשנייה בקונטקסט ארוך

אנבידיה מרחיבה את ורה רובין עם גרוק 3 LPX בייצור מלא, מציגה 3,400 טוקנים לשנייה בקונטקסט ארוך

הביצועים במספרים

במבחן Artificial Analysis שהריץ את Gemma 4 31B (מודל סוכני (agentic) במשקלים פתוחים) המערכת סיפקה 3,400 טוקני פלט לשנייה בחלון קונטקסט של 100 אלף טוקנים, פי ארבעה מהפלטפורמה הקרובה ביותר. הנתון מתייחס ספציפית לתרחישי הסקה ארוכי-קונטקסט שקריטיים למערכות מרובות-סוכנים, לא ל-throughput גנרי.

השותפים הראשונים בשטח

Nebius, ענן AI מוביל, ראשונה לאמץ את גרוק 3 LPX ותשלב אותו ב-Nebius Token Factory לצד מדפי ורה רובין NVL72. CoreWeave כבר פרשה בייצור את Spectrum-X Multiplane, ארכיטקטורת רשת שמחברת מדפי ורה רובין דרך מתגים מקבילים לרשת שטוחה, חסרת אובדן ורוחב פס גבוה. SpaceXAI הודיעה שתבסס את ארכיטקטורת ה-AI העתידית שלה על מעבדי ורה, ממרכזי נתונים קרקעיים ועד לוויינים במסלול.

קוד-עיצוב קיצוני כעיקרון מארגן

ההכרזה הגיעה השבוע בכנס Hot Chips בפאלו אלטו. אנבידיה מציגה גישה של "קוד-עיצוב קיצוני" (extreme codesign): חישוב, רשת והאצת הסקה מתוכננים כמערכת מאוחדת במקום רכיבים נפרדים. Spectrum-X Ethernet מטפל בזרימת הנתונים המאסיבית בין המדפים, גרוק 3 LPX מתמקד בייצור טוקנים בזמן שיהוי נמוך במיוחד, וורה רובין NVL72 משמש כפלטפורמת המפעל הגמישה ביותר לטענת החברה.

מהאימון להסקה, תשתית חדשה נדרשת

המעבר מאימון להסקה (inference) ולמערכות סוכניות מייצר דרישות שונות מהותית: נפחי טוקנים גדלים, חלונות קונטקסט מתרחבים דרמטית, וסוכנים משתפים פעולה ביניהם לפתרון בעיות מורכבות. התשתית הנדרשת לא נמדדת רק בביצועי שיא אלא ב-throughput, רספונסיביות וכלכלה בקנה מידה חסר תקדים. אנבידיה ממצבת את הפלטפורמה כמנוע משולב שהופך נפחי טוקנים הולכים וגדלים להכנסה, ניסוח שמדגיש את הזווית העסקית מאחורי הארכיטקטורה.

מקור: blogs.nvidia.com