1 באוקטובר 2026 האקדמיה ארכיון
מבזקים
אלן משיקה את Olmo-core 3: סטאק אימון MoE שמגיע לטריליון פרמטרים בלי לקרוס סאטליט גייסה 8 מיליון דולר ומשגרת תוכנת בינה מלאכותית לחלל על גבי טיל של ספייס-אקס אופן-איי משיקה את GPT-6.1 סול: ביצועי אסטרה בקידוד סוכני בחמישית המחיר גוגל משיקה את ג'מיני 4 ארגון, מודל דגל חדש שנבדק עם הממשל האמריקאי שופט פדרלי דחה תביעות הגבלים עסקיים של צ'ג ו-PMC נגד AI Overviews של גוגל
מוצרים

מפעלי AI של NVIDIA: תפוקה שוברת שיאים וחומרה שממשיכה להרוויח שנים אחרי ההשקה

מפעלי AI של NVIDIA: תפוקה שוברת שיאים וחומרה שממשיכה להרוויח שנים אחרי ההשקה

NVIDIA מגדירה מחדש את הכלכלה של מפעלי בינה מלאכותית עם שלושה עקרונות, פרודוקטיביות, עמידות וגמישות, שנועדו למקסם החזר השקעה במתקנים שעלותם מגיעה לכ-60 מיליון דולר (כ-220 מיליון שקל) למגה-ואט בודד. החברה טוענת שהשילוב בין תפוקת טוקנים מקסימלית לוואט, אורך חיים כלכלי שנמתח הרבה מעבר לתחזיות המקוריות, ויכולת להריץ כל סוג עומס עבודה, הוא שמכריע אם מפעל כזה יחזיר את ההון שהושקע בו.

פרודוקטיביות: 30x יותר תפוקה למגה-ואט

החשמל הוא צוואר הבקבוק הקשיח, ולכן טוקנים לשנייה למגה-ואט הוא המספר שקובע את פוטנציאל ההכנסה. לפי נתוני SemiAnalysis AgentX, מערכות Vera Rubin NVL72 מספקות פי 30 יותר תפוקה למגה-ואט בהשוואה ל-GB300 NVL72, ועד פי 45 עלות נמוכה יותר למיליון טוקנים במודל DeepSeek V4 Pro. הקפיצה נובעת מקודיזיין קיצוני לאורך כל המחסנית, ממודלים ועומסי עבודה, דרך תוכנה, ועד מחשוב, רשת וזיכרון שפותחו יחד. התוצאה הישירה: יותר הכנסה בתוך מעטפת הספק קבועה, ושולי רווח רחבים יותר על כל טוקן.

כשהטוקנים זולים יותר, הביקוש גדל, לא קטן

השאלה המתבקשת היא האם הוזלה דרמטית כזו מצמצמת את הצורך בכוח מחשוב. התשובה של NVIDIA שלילית: טוקנים זולים הופכים עוד מקרי שימוש לכדאיים כלכלית, ואלה צורכים יותר טוקנים ממה שההתייעלות חסכה. זהו אפקט ג'בונס קלאסי שפועל גם כאן, יעילות מרחיבה את השוק במקום לכווץ אותו. הגמישות (Fungible) משלימה את התמונה: אותן מערכות מריצות כל סוג AI, אימון, הסקה, fine-tuning, וגם עומסים שאינם AI בכלל, דרך ספריות CUDA-X וארכיטקטורה סטנדרטית שזמינה בעיצוב ייחוס מאומת.

עמידות: A100 מ-2020 עדיין מכניס כסף

לא כל עומס צריך את הדור החדש ביותר. ה-A100 שהושק ב-2020 עדיין בשירות מסחרי פעיל שש שנים אחרי, ו-CoreWeave האריכה הזמנות ליחידות מאותו דור עד 2029. כל המפעילים הגדולים האריכו שוב ושוב את לוחות הפחת, האומדן מתי החומרה מפסיקה להרוויח, וזה ממשיך לזוז קדימה. ניתוח של Sprout מספטמבר 2026, "The Productive Life of a Data Center GPU", מתעד את המגמה אצל כל השחקנים המרכזיים.

השוק המשני מאשר: החומרה שווה הרבה יותר מאפס

נתוני שוק עצמאיים מחזקים את הטענה. Barkr מעריכה חיים שימושיים של 5-6 שנים למערכת 8-GPU H100, ו-9-10 שנים ל-GB300 NVL72, בהתבסס על מחירי מכירה חוזרת. Silicon Data מראה ש-A100 בן שש עדיין שווה רבע מעלותו המקורית, בעוד לוח פחת של חמש שנים כבר הוריד אותו לאפס לפני יותר משנה. Ornn Data מוצאת שהשוק מוכן לשלם 80% ממחיר חוזה חודשי עבור חוזה לחמש שנים על אותו GPU, אינדיקציה ברורה לאמון בהמשך התפוקה.

מקור: blogs.nvidia.com