21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
מחקר

מודל שמבצע, לא רק חושב

מודל שמבצע, לא רק חושב

אפודקס (Apodex) 1.1 לא מנסה להיות מודל שפה גדול יותר, הוא מנסה להיות מודל שעובד. המאמר שפורסם ב-arXiv (מספר 2608.23283) מגדיר "יכולת עבודה" (working capability) כהתקדמות מתמשכת וניתנת לאימות לעבר יעד בעולם האמיתי, והמשפחה החדשה נבנתה סביב ההגדרה הזו. במקום להסתמך רק על חשיבה וסינתזת ידע, המערכת משלבת אינטראקציה מתמשכת עם קבצים, מקורות מידע וקוד בר-ביצוע, יחד עם תחזוקת מצב, התאוששות מכשלים ומסירה ניתנת לאימות.

שני וקטורי סקיילינג

הפיתוח מתקדם בשני צירים משלימים. הראשון, Environment Scaling, מרחיב את המגוון והאימותיות של סביבות ביצוע, קבצים, חיפוש וקוד, כך שהסוכן (agent) פועל בתנאים שקרובים לעבודה מקצועית אמיתית. השני, Agentic Coordination Scaling, מאמן סוכנים לפרק משימות ארוכות-אופק (long-horizon), להאציל עבודה במקביל, לשלב תוצאות אסינכרוניות ולתכנן מחדש כשהדברים משתבשים. רתמת ביצוע משותפת (execution harness) ו-AgentOS שומרים על מצב המשימה ומקור הנתונים (provenance) לאורך כלים וסוכנים שונים, והאימון הופך מסלולי סביבה ועקבות תיאום להתנהגות אמינה.

ביצועים עם מודל קטן יותר

לפי הדיווח, אפודקס 1.1 מגיע לרצועת הביצועים המובילה במגוון תחומים, עבודה מקצועית מורכבת, פיננסים, מחקר מדעי, מתמטיקה, קוד וחיפוש עמוק, כשהוא משתמש במודל קטן משמעותית ממערכות חזית (frontier) רבות. גרסת המיני, 35 מיליארד פרמטרים, שומרת על יכולת עבודה חזקה בגרסה ניתנת לפריסה מקומית (locally deployable), מה שפותח את הדלת לארגונים שלא רוצים או לא יכולים לשלוח נתונים לענן.

סביבת עבודה פתוחה למחקר

החבילה כוללת שלושה רכיבים זמינים כעת: אפודקס 1.1 המלא דרך סביבת העבודה המקוונת, אפודקס 1.1 מיני במשקולות פתוחות (open weights) להרצה מקומית, ו-FrontierAgent, סביבת עבודה מחקרית (research workbench) בקוד פתוח שכוללת גם את מנגנון "צוות סוכנים אסינכרוני" (Asynchronous Agent Team) המאפשר התערבות והכוונה אנושית בכל שלב. הקוד והמשקולות זמינים במאגרים המקושרים מההודעה.

הקשר מחקרי רחב יותר

המאמר מצטרף לגל פרסומים עדכניים שעוסקים בסוכנים לאופקים ארוכים: Argus, LongHorizon-Harness, AstronOS, StructAgent, Agentao ואחרים, כולם מ-2026, מה שמסמן כיוון ברור בקהילת המחקר: מעבר ממודלים שעונים לשאלות למערכות שמבצעות עבודה מתמשכת, ניתנת למעקב ולתיקון.