הכנס שגדל פי שניים והמירוץ לטוקנים למגה-ואט

יותר מ-8,000 איש נדחסו למרכז הכנסים של סנטה קלרה השבוע, יותר מפי שניים מהשנה שעברה, ובאיי אינפרה (AI Infra Summit) הפך רשמית לקואצ'לה של תשתיות בינה מלאכותית. איאן באק (Ian Buck), סגן נשיא להייפרסקייל ול-HPC באנבידיה, עלה לבמה כדי למסגר את הבעיה: עומסי העבודה הסוכניים (agentic) דורשים ביצועים, יעילות וקנה מידה מסדר גודל אחר, והמדד שמכריע כעת אינו שיא ביצועים אלא טוקנים מאומתים למגה-ואט.
ורובין, דינמו והמעבר לטוקנים למגה-ואט
אנבידיה מציגה מענה מלא-מחסנית (full-stack) שמחבר בין מערכות ורה רובין (Vera Rubin), תוכנת ההסקה דינמו (Dynamo), ספריות נמו (NeMo) ושכבת רשת הכוללת NVLink להרחבה אנכית (scale-up), ספקטרום-איקס (Spectrum-X) איתרנט וקונקט-איקס (ConnectX) SuperNICs לחיבור אלפי צמתים, לצד אחסון הקשר-זיכרון מבוסס בלו-פילד (BlueField) ו-DPUs לאבטחת תשתית. לפי החברה, DSX MaxLPS מסוגל לספק עד פי 1.4 יותר טוקנים למגה-ואט באמצעות אופטימיזציית הספק ברמת המפעל כולו, בעוד NVLink מאחד מחשוב מואץ בקנה מידה גדול למערכת יחידה בעלת ביצועים גבוהים.
למבדה מראה 23% שיפור בוואט
ספקית הענן למבדה (Lambda) פרסמה את הוולידציה הראשונה של DSX MaxLPS על שרתי בלקוול (Blackwell) של אנבידיה, ודיווחה על שיפור של 23% בביצועים לוואט. המערכת מנטרת ברצף את צריכת ההספק על פני GPU-ים ומדפים, ומבצעת אופטימיזציה דינמית שמאפשרת להוציא יותר תפוקה מכל מגה-ואט שזמין במתקן. זוהי הוכחת יכולת ראשונה בשטח לטכנולוגיה שאנבידיה מקדמת כמפתח ליעילות מפעלי AI.
אמרלד והרשת: מפעל AI כמשאב גמיש
אמרלד AI (Emerald AI) הדגימה עם סיליקון ואלי פאואר (Silicon Valley Power) תוכנית גמישת-עומס (flexible-load) מסחרית ראשונה מסוגה. המערכת הגיבה אוטומטית למאות אותות ביקוש מהרשת תוך הגנה על ביצועי עומסי ה-AI הקריטיים. אמרלד מתכננת לשלב את DSX Flex בתוכנת הקונדקטור (Conductor) שלה, שמתאימה צריכת אנרגיה בזמן אמת לאותות רשת, בקשות השלת עומס, אירועי תגובה-לביקוש ואותות תמחור, ופועלת בתוך היררכיית עומסים מוגדרת מראש: המשימות הקריטיות ממשיכות, השאר מושהות זמנית וחוזרות כשהמצב מאפשר. התוצאה היא מפעל AI שמתפקד כמשאב רשת גמיש, מסוגל לפנות קיבולת כשהרשת זקוקה להקלה ולהחזיר אותה כשאפשר.
שיתופי פעולה שמרחיבים את האקוסיסטם
במקביל הכריזה אנבידיה על שיתוף פעולה עם אמאזון אנפורנה לאבס (Annapurna Labs) לפיתוח זיכרון רחב-פס מותאם (NVHBM), ועל אינטגרציה של NVLink Fusion עם מעבדי ראפטור (Raptor) של d-Matrix. פינטרסט (Pinterest) כבר מריצה בינה מלאכותית שיחתית לגילוי חזותי על גבי פלטפורמת בלקוול ותוכנת דינמו. כל אלה מצטרפים למגמה ברורה: התעשייה עוברת ממרוץ אחר שיאי FLOPS לתחרות על כל טוקן שיוצא מכל ואט, והקוד שמנהל את ההספק ברמת המפעל הופך חשוב לא פחות מהסיליקון עצמו.