13 באוגוסט 2026 האקדמיה ארכיון
מבזקים
אפליקציית ChatGPT שולחנית ללינוקס יוצאת בתצוגה מקדימה עם קודקס מובנה DeepSeek-V4-Pro מגיע למקום 8 בקוד ארנה, שני בין המודלים הפתוחים דינה רובוטיקס משחררת מודל עולם-פעולה שפותח על מיליון שעות וידאו אנושי נמוטרון 3.5 לייטנינג נוחת בפריים אינטלקט עם תמיכה מיום אפס התפרצות כבד שומני עולמית: בינה מלאכותית עשויה להקדים תרופה למכה
מודלים

Liquid AI משחררת מודל סוכן שרץ על הטלפון

מאת הדר מזרחי כתב/ת AgentNet
Liquid AI משחררת מודל סוכן שרץ על הטלפון

משקלים פתוחים, לא קוד פתוח

Liquid AI השיקה את LFM2.5-2.6B, מודל בן 2.6 מיליארד פרמטרים שמתוכנן לפעול כסוכן מקומי: תכנון פעולות, קריאה לכלים וביצוע משימות מרובות שלבים, הכול על המכשיר, בלי קריאת API לענן. החברה מגדירה את הגרסה כ"open-weight"; נתוני האימון וקוד האימון עצמו לא פורסמו.

ארכיטקטורה: מומחים שמזוקקים למודל אחד

המודל אומן על כ-34 טריליון טוקנים, עם אוצר מילים של 128 אלף טוקנים וחלון הקשר של 128 אלף. תהליך הכוונון נעשה בשלבים: מודלים-מומחים נפרדים שופרו במתמטיקה, קוד, שימוש בכלים וקונטקסט ארוך; לאחר מכן הועברו היכולות למודל יחיד באמצעות זיקוק on-policy; השלב האחרון התבצע בתוך סביבות סוכניות אמיתיות, בהן Hermes Agent ו-OpenClaw.

ביצועים: מ-30 טוקן לשנייה בטלפון ועד 15 אלף ב-H100

לפי נתוני Liquid AI, המודל מייצר עד 220 טוקנים לשנייה על Apple M5 Max, כ-113 טוקנים לשנייה על Ryzen AI Max+ 395, וכ-30 טוקנים לשנייה על סמארטפון. על H100 בודד בעומס מקבילי גבוה מגיע הקצב לכ-15 אלף טוקני פלט בשנייה. צריכת הזיכרון על CPU נשארת מתחת ל-2.5 גיגה-בייט, מה שמאפשר הרצה נוחה גם על חומרה צנועה.

בנצ'מרקים: מנצח גדולים יותר בכלים, מפגר בקוד מורכב

במבחני החברה, LFM2.5-2.6B עוקף מודלים גדולים יותר ממשפחות Gemma ו-Qwen במשימות הוראות ושימוש בכלים. בקידוד מורכב המודלים הגדולים עדיין שומרים על יתרון. התמיכה כוללת llama.cpp, MLX, vLLM, SGLang ו-ONNX, עם גרסת בסיס וגרסת הוראות זמינות להורדה.