13 באוגוסט 2026 האקדמיה ארכיון
מבזקים
אפליקציית ChatGPT שולחנית ללינוקס יוצאת בתצוגה מקדימה עם קודקס מובנה DeepSeek-V4-Pro מגיע למקום 8 בקוד ארנה, שני בין המודלים הפתוחים דינה רובוטיקס משחררת מודל עולם-פעולה שפותח על מיליון שעות וידאו אנושי נמוטרון 3.5 לייטנינג נוחת בפריים אינטלקט עם תמיכה מיום אפס התפרצות כבד שומני עולמית: בינה מלאכותית עשויה להקדים תרופה למכה
מודלים

הסטאק שמחזיק את הסוכנים בחיים מגיע לסן פרנסיסקו

מאת הדר מזרחי כתב/ת AgentNet
הסטאק שמחזיק את הסוכנים בחיים מגיע לסן פרנסיסקו

האירוע השני בסדרת The AI Dev Stack מתמקד בשכבה שמתחת לסוכני הקוד, התשתית שמאפשרת להם לרוץ בפרודקשן בלי להתפרק. אנטימטל, פיירוורקס, בריינטראסט ובראוזרבייס יציגו כל אחד הדגמה של שבע דקות, ואז יענו לשאלות. לא מדובר בכנס גדול אלא במפגש ממוקד שמכוון למפתחים שבונים את השכבות האלה ביומיום.

אנטימטל: לסנן רעש בהתראות

שרייאס אייר (Shreyas Iyer), סמנכ"ל טכנולוגיה ואחד המייסדים של אנטימטל, יציג את Triage, כלי שמקבץ אירועים קשורים לבעיות (issues) ולומד אילו סיגנלים באמת חשובים לצוות. הרעיון פשוט: במקום להציף מפתחים באלפי התראות, המערכת מזהה דפוסים חוזרים ומציפה רק את מה שדורש התערבות. אייר לא פרסם מדדי ביצועים או נתוני השוואה מול פתרונות קיימים, אז קשה להעריך כמה זה אפקטיבי בסקייל אמיתי.

פיירוורקס: איוולים כחומר אימון

סינאן אוזדמיר (Sinan Ozdemir), ראש חינוך מפתחי AI בפיירוורקס, ידגים איך הופכים קייסים שנכשלו באיוול (evaluation) לדאטה לפיין-טיונינג. המתודולוגיה משווה שלושה מסלולים: API של מודל חזית (frontier), מודל פתוח בגרסת הבסיס, ואותו מודל פתוח אחרי פיין-טיונינג על הכשלונות שלו עצמו. זו גישה שמחזירה את הלופ הסגור בין הערכה לאימון, אבל בלי בנצ'מרקים פומביים קשה לדעת אם התוצאה באמת עוברת את ה-API המסחרי.

בריינטראסט: לסגור את הפער בין דמו לפרודקשן

חוסיין ניאזמנדי (Hossein Niazmandi), ראש הנדסת פתרונות בבריינטראסט, מתמקד בבעיה המוכרת: סוכן שעובד בדמו ונכשל כשמשתמשים אמיתיים מגיעים. הפתרון שלהם הופך כשלונות אמיתיים בפרודקשן לאיוולים שתופסים רגרסיות לפני שהן מגיעות ללקוחות. זהו בעצם CI/CD להתנהגות של סוכנים, רעיון נכון ארכיטקטונית, אבל המימוש תלוי באיכות האינסטרומנטציה וביכולת לשחזר כשלונות בסביבת פיתוח.

בראוזרבייס: לתת לסוכנים ידיים ברשת

שריי פנדיה (Shrey Pandya), מהנדס צמיחה בבראוזרבייס, יציג איך הפלטפורמה נותנת לסוכנים את ה"רתמה", הכלים והגישה שהם צריכים כדי לנווט ברשת טוב יותר מבן אדם. המשמעות המעשית: דפדפן מנוהל עם יכולות אוטומציה, טיפול ב-CAPTCHות, ניהול סשנים וזהויות, כל התשתית שסוכן צריך כדי לפעול באתרים שלא נבנו עבור API. בראוזרבייס לא חושפת נתוני ביצועים השוואתיים מול פליירייט (Playwright) או פאפיטיר (Puppeteer) בסטאפ עצמאי.

מה שמסתמן מהליין-אפ

ארבע ההרצאות יחד משרטטות את הקונצנזוס המתהווה: הבעיה כבר לא "איך כותבים קוד עם LLM" אלא איך מנטרים, מעריכים, מתקנים ומאפשרים גישה לעולם החיצון. כל חברה תוקפת זווית אחרת, רעש התראות, לופ אימון-הערכה, אמינות בפרודקשן, גישה לרשת, ואף אחת לא מוכרת "סוכן קוד" כשלעצמו. זה הסטאק האמיתי שצריך לבנות לפני שסוכנים הופכים למוצר יציב.