13 באוגוסט 2026 האקדמיה ארכיון
מבזקים
אפליקציית ChatGPT שולחנית ללינוקס יוצאת בתצוגה מקדימה עם קודקס מובנה DeepSeek-V4-Pro מגיע למקום 8 בקוד ארנה, שני בין המודלים הפתוחים דינה רובוטיקס משחררת מודל עולם-פעולה שפותח על מיליון שעות וידאו אנושי נמוטרון 3.5 לייטנינג נוחת בפריים אינטלקט עם תמיכה מיום אפס התפרצות כבד שומני עולמית: בינה מלאכותית עשויה להקדים תרופה למכה
מוצרים

מונשוט הסינית שיחררה את קימי K3, אבל הסיפור האמיתי מסתתר בשתי הדגמות צדדיות: סוכן AI שתכנן שבב מאפס

מאת הדר מזרחי כתב/ת AgentNet
מונשוט הסינית שיחררה את קימי K3, אבל הסיפור האמיתי מסתתר בשתי הדגמות צדדיות: סוכן AI שתכנן שבב מאפס

ב־48 שעות, ועוד אחד שכתב קומפיילר ל־GPU בלי שאף מהנדס ירים יד מהמקלדת. בזמן שכולם בודקים בנצ'מארקים של צ'אט, החברה מבייג'ינג מראה לאן נושבת הרוח, מסייעי קוד למהנדסים וירטואליים שמנהלים פרויקט הנדסי שלם, כולל דיבאג ואופטימיזציה, במשך יומיים רצופים בלי לבקש קפה. פיתוח שבב הוא בדרך כלל סיוט לוגיסטי של חודשים עד שנים, צוותים של עשרות אנשים ושרשרת כלים יקרה להחריד, הגדרת ארכיטקטורה, כתיבת RTL, סימולציות, וריפיקציה, סינתזה, טיימינג, פיזיקל דיזיין וטייפ־אאוט. מונשוט זרקה את קימי K3 למים העמוקים עם משימה צנועה לכאורה: תכנן מאיץ AI קטן. הסוכן הריץ את התהליך על כלי EDA בקוד פתוח, ובסוף התקבל תכנון מלא של דיא בגודל 4 מ״מ רבוע על נוד 45 ננומטר, עם 1.46 מיליון תאים לוגיים, 0.277 מגה־בייט SRAM ומערך INT4 MAC שהגיע ליותר מ־8,700 טוקנים לשנייה בסימולציה. זה לא שבב שייצא לייצור המוני מחר, והנוד ותיק יחסית, אבל היכולת להחזיק קונטקסט הנדסי כזה לאורך 48 שעות אוטונומיות היא קפיצת מדרגה שלא רואים כל יום.

ההדגמה השנייה, מיני־טרייטון (MiniTriton), אולי מעניינת אפילו יותר את התעשייה. הסוכן לא רק כתב קוד, הוא תכנן את ארכיטקטורת הקומפיילר, מימש את הרכיבים, הריץ בנצ'מארקים וביצע איטרציות שיפור לבד. טריטון המקורי של OpenAI הפך לסטנדרט דה־פקטו לכתיבת קרנלים יעילים בלי לכתוב CUDA ביד, ומונשוט מראה שסוכן יכול להרים תשתית כזו מאפס. הם לא טוענים שזה מחליף את הסטאק של NVIDIA, אבל זו הוכחת יכולת מרשימה לכתיבת תוכנת מערכת מורכבת בלי יד אדם על ההגה.

קימי K3 עצמו הוא חתיכת מפלצת: מודל Mixture of Experts עם 2.8 טריליון פרמטרים, שמפעיל רק 16 מתוך 896 מומחים בכל טוקן כדי לשמור על עלות חישוב שפויה. יש שם כמה טריקים חדשים, Kimi Delta Attention לייעול אטנשן בקונטקסטים ארוכים, Attention Residuals לזרימת מידע טובה יותר בין שכבות, ו־Stable LatentMoE לאיזון עומסים בין המומחים. חלון הקונטקסט מגיע למיליון טוקנים, והביצועים לפי מונשוט מתקרבים למודלי החזית של OpenAI, אנתרופיק וגוגל. העובדה שהם משחררים את זה כ־Open Weight עשויה להאיץ אימוץ מהיר בקהילת המחקר ובתעשייה.

השורה התחתונה לא קשורה רק לביצועי צ'אט. מונשוט מדגימה כאן את המעבר ממודלים שעונים על שאילתות לסוכנים שמנהלים פרויקטים הנדסיים ארוכים, מה שמכונה בעגה המקצועית "סוכנים אוטונומיים". אם היכולת הזו תתבגר ותהפוך לאמינה בייצור, הדור הבא של מהנדסי וריפיקציה, בקאנד וקומפיילרים לא יעבוד לבד, אלא ינהל צי של סוכנים שסוגרים פינות בזמן שהם הולכים לאכול צהריים.

מקור: techtime.co.il