21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
מודלים

גוגל משחררת את מנטיס: ערכת כישורים מודולרית לסוכני קוד שמאתרים ומתקנים חולשות

גוגל משחררת את מנטיס: ערכת כישורים מודולרית לסוכני קוד שמאתרים ומתקנים חולשות

גוגל פרסמה בקוד פתוח את Mantis, ערכת כישורים (skills toolkit) מודולרית שמאפשרת לסוכן קוד (coding agent) קיים להריץ את מחזור החיים המלא של טיפול בחולשות, מאיתור חשד, דרך סינון חיוביים שגויים, שחזור בארגז חול, כתיבת תיקון מינימלי, תקיפה חוזרת של התיקון, ועד ניקוד סיכון שיורי. בניגוד לסורק סטטי שמכוונים למאגר ושוכחים, מנטיס בנויה כסט פקודות קו נטוי (slash commands) שהסוכן טוען, בתוספת כללים נוקשים היכן מותר לו להריץ קוד. הערכה זמינה כבר היום לשימוש מקומי והערכה פנימית תחת רישיון Apache 2.0, אך בגוגל מדגישים שהיא עדיין לא מומלצת לסביבת ייצור ואינה מוצר נתמך רשמית של החברה.

הצנרת: שלבים כפקודות נפרדות

הפייפליין של מנטיס מפורק לספריות כישורים נפרדות, שכל אחת מהן מופעלת כפקודה ומשורשרת ברצף; כישור מפקח בשם `/mantis-meta-agent` יכול להניע את הלולאה כולה בסשן ארוך-חיים. השלבים המוקדמים לומדים את היעד: `/mantis-history` כורה את היסטוריית בקרת הגרסאות לתיקוני אבטחה קודמים, `/mantis-summarize` כותב מפות ספריות, `/mantis-architecture` בונה בסיס ידע במרקדאון, `/mantis-threat-model` גוזר גבולות אמון, ו-`/mantis-plan` מייצר מפת דרכים ממוקדת. שלבי האמצע מאתרים ומסננים: `/mantis-researcher` סורק קבצים מול התוכנית, ואז `/mantis-dedupe`, `/mantis-review` ו-`/mantis-critic` מקפלים כפילויות, מחילים כללי שלילה, ומשליכים ממצאים שלא יכולים להופיע בבניית שחרור. שלבי הסוף מוכיחים ומתקנים: `/mantis-reproduce` מריץ מטענים (payloads) ב-gVisor או מכונה וירטואלית עם רשת מנותקת, `/mantis-chain` מרכיב שרשראות ניצול רב-שלביות מממצאים מאומתים, `/mantis-patch` מחיל ומאמת את התיקון, `/mantis-calibrate` מקצה ציון סיכון 1 עד 10, `/mantis-reflect` כותב לקחים למעבר הבא, ו-`/mantis-report` מפיק חבילת סקירה קריאת-אנוש.

גבול האמון: שחזור ותקיפה חוזרת

מה שהופך את מנטיס למעניינת אינו עוד מודל שפה גדול יותר, אלא הבחירה הארכיטקטונית להתייחס לשחזור (reproducer) ולתקיפה החוזרת (re-attack) כגבול האמון (trust boundary). רוב הכלים הסוכניים לאבטחה נעצרים בייצור ממצאים; מנטיס דורשת הוכחה שהבאג קיים בפועל בסביבה מבודדת, ואז בודקת שהתיקון אכן חוסם את הניצול. נוסף על כך, גוגל מפרסמת את החוזים בין השלבים (inter-stage contracts) כדי שצוותים יוכלו לעטוף את הכישורים ברתמה דטרמיניסטית במקום לסמוך על LLM שיתזמן פקודות מעטפת (shell commands) באורח חופשי.

מספרים: קיצוץ טוקנים ושיעור חיוביים אמיתיים נמוך

לפי גוגל, עץ סיכום היררכי (hierarchical summary tree) מקצץ את תקורת הטוקנים ביותר מ-85 אחוזים, נתון משמעותי כשמדובר בקוד-בסיסים גדולים. החברה מצטטת שיעור חיוביים אמיתיים (true-positive rate) של פחות מ-7 אחוזים בסריקת קוד נאיבית על ידי AI כבעיה שמנטיס נועדה לפתור; המספר הזה ממחיש מדוע סינון אגרסיבי ושחזור בפועל קריטיים לפני שמפתחים מבזבזים זמן על רעש.

כישור מניעתי: ייעוץ לפני כתיבה

כישור חדש יחסית, `/mantis-advise`, הופך את הזרימה: הוא מתשאל את מודל האיומים המצטבר, שושלות באגים קודמות ותבניות תיקון מאומתות עוד לפני שנכתבת שורת קוד, במטרה למנוע מאותה מחלקת באג לנחות פעמיים. הגישה הזו מזיזה את הכלי ממצב תגובתי למצב מונע, אם כי יעילותו בפועל תיבחן רק כשצוותים יתחילו לשלב אותו בזרימות עבודה יומיומיות.

זמינות ומסגרות נתמכות

את הקוד אפשר לשכפל ממאגר `google/mantis` בגיטהאב ולהריץ עם Gemini CLI, Antigravity CLI, ה-ADK של גוגל, או כל מסגרת סוכנים מקבילה. התיעוד כולל מדריך התחלה מהירה, מדריך אסמכתא לסוכנים, ופרספקטיבה של CISO הענן. בשורה התחתונה: מנטיס אינה קסם שפותר אבטחה בלחיצת כפתור, אלא תשתית מודולרית שמאפשרת לבנות תהליך מאומת ומדיד, בתנאי שיש לכם את הסוכן, את המשאבים להריץ ארגזי חול, ואת הסבלנות לכוונן את הכללים.

מקור: marktechpost.com