d-Matrix מצטרפת ל-NVLink Fusion ומדלגת על כאב הראש של פריסת ראקים מותאמים

הסיליקון הוא רק ההתחלה
d-Matrix, יצרנית שבבי ה-XPU להרצת מודלים (inference), הודיעה אתמול שהיא מאמצת את NVLink Fusion של NVIDIA כדי לחבר את הדור הבא של מעבדי Raptor לפלטפורמת ה-AI של NVIDIA. המהלך מכניס אותה לרשימת שותפי האקוסיסטם שמקבלים גישה ישירה לארכיטקטורת הראק MGX, לרשתות Spectrum-X ולשרשרת האספקה המוכחת של NVIDIA, במקום לבנות את כל הערימה הזו מאפס.
למה זה חוסך זמן וכסף
לדברי סיד שיית' (Sid Sheth), מייסד משותף ומנכ"ל d-Matrix, הביקוש להרצה (inference) מזנק אבל הון, זמן ואנרגיה נשארים סופיים. שיית' הסביר שבאמצעות NVLink Fusion וארכיטקטורת MGX המקוררת נוזלית, החברה יכולה לשלב את מעבדי Raptor בפלטפורמה שכבר פרוסה בשטח, ולתת ללקוחות מסלול מהיר יותר ועם פחות סיכון לפריסת הרצה באחזור נמוך במיוחד (ultralow-latency). בניית ה-XPU היא רק השלב הראשון; פריסה בקנה מידה של "מפעל AI" דורשת נטוורקינג, ארכיטקטורת ראק, חשמל, קירור, תוכנה ושרשרת אספקה, כל שלב מוסיף עלות, זמן וסיכון.
ארכיטקטורת הפריסה: Scale-up אחד גדול
באמצעות NVLink, d-Matrix מתכננת לחבר את ה-XPU שלה לדומיין scale-up יחיד ברוחב פס גבוה ואחזור נמוך. הראקים האלה יוכלו לעבוד לצד מערכות מבוססות GPU של NVIDIA כמו Vera Rubin NVL72 לטובת הרצה מבוזרת (disaggregated inference). במקביל, החברה משלבת מעבדי Vera של NVIDIA, כרטיסי ConnectX-9 SuperNIC, יחידות BlueField-4 DPU ורשתות Spectrum-X Ethernet, יחד עם NVLink ו-MGX זה נותן בסיס מוכח לפריסת הרצה ייעודית לצד מערכות NVIDIA בתוך מפעלי AI גמישים ומאוחדים.
פלטפורמה "ניתנת להחלפה" לכל עומס עבודה
פלטפורמת ה-AI factory המלאה של NVIDIA כוללת כעת את Vera Rubin NVL72, Groq 3 LPX, ראק מעבדי Vera, אחסון Vera BlueField-4 STX ורשתות Spectrum-6 SPX Ethernet. המערכת מתוכננת להיות fungible לחלוטין, להריץ כל עומס עבודה, מודל וארכיטקטורת מודל עם הביצועים לוואט הטובים ביותר והעלות הנמוכה ביותר לטוקן. NVLink Fusion הוא המפתח שמאפשר ללקוחות להתאים את המחשוב הנכון לכל משימה בתוך פלטפורמה משותפת, וליזמי סיליקון כמו d-Matrix להגדיל ביצועים, לקצר זמן לשוק ולהקטין סיכונים בפריסת מפעלי AI חצי-מותאמים.