21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
מוצרים

ורסל משיקה כלי חינמי לבדיקת מוכנות אתרים לסוכני AI

ורסל משיקה כלי חינמי לבדיקת מוכנות אתרים לסוכני AI

מה בודקים בדיוק

ורסל (Vercel) שחררה את Is Agentic, כלי ציבורי שנותן ציון מספרי למידת המוכנות של אתר לגילוי, גישה, הבנה ושימוש על ידי סוכני AI. את הסריקה והניקוד מבצעת אורה (Ora), חברת מחקר חוויית סוכנים ממעבדות ארה (era labs); ורסל מפעילה את הממשק, דוחות התוצאות, האחסון ואת הלוגיקה שמציגה את הציון הסופי. הכלי זמין ללא עלות, בלי תוכניות בתשלום, בלי מפתח API ובלי חשבון חיוב, אפשר להזין כתובת בדפדפן או להריץ מה-CLI עם `npx is-agentic <domain>` ולקבל JSON בדגל `--json`.

ארבע שכבות ומאה ומשהו בדיקות

המתודולוגיה של אורה מחלקת את המסע של סוכן לארבע שכבות: גילוי (Discovery), 20 נקודות על 15 בדיקות; גישה (Access), 30 נקודות על 41 בדיקות; שמישות (Usability), 40 נקודות על 56 בדיקות; ותשלומים (Payments), 10 נקודות על 6 בדיקות. סך הכול 118 בדיקות, תואם את הטענה של ורסל ל-"100+ בדיקות". באורה אומרים שהרשימה נגזרה מהרצות אמיתיות של סוכנים, לא מדעה סובייקטיבית. סולם האותיות: A+ ב-95-100, A ב-86-94, B ב-70-85, C ב-48-69, D ב-28-47, F ב-0-27.

מודל הניקוד של ורסל

ורסל מארגנת מחדש את הבדיקות למודל תצוגה משלה: בדיקות חיוניות (Essential) חולקות בריכה של 80 נקודות, בדיקות מומלצות (Recommended), 20 נקודות, ואותות מתהווים (Emerging) מוסיפים בונוס של עד 5 נקודות כשהם קיימים, ואף פעם לא מורידים ציון כשהם חסרים. בדיקות לא-רלוונטיות מוחרגות מהחישוב במקום להיספר ככישלון, ותוצאות חלקיות מקבלות קרדיט יחסי. הלוגיקה הזו משמעותית: בדיקות מומלצות מופעלות רק כשהסריקה מזהה בוודאות API, זרימת OAuth, נקודת קצה GraphQL, שרת MCP, פורטל מפתחים או משטח מסחר, אתר שיווקי לא נענש על היעדר ממשק שהוא מעולם לא הצהיר שיש לו.

מה מקבלים בדוח

כל ממצא מגיע עם ראיות שנצפו, ובמקרים הרלוונטיים, המלצה קונקרטית לתיקון. תגובת API חיה חושפת את המבנה: ציון, תווית, זמן סריקה, מספר הבדיקות הזכאיות, פירוט נקודות שהושגו וזמינות לכל דרג, ומערך בעיות. כל בעיה נושאת מזהה, שם, פירוט, המלצה, תוצאה ודרג. דוגמאות למזהי בדיקות אמיתיים: `content-no-js`, `agent-friendly-404`, `markdown-negotiation-vary`, `json-ld`, `sitemap`, `trust-anchors`, `metadata-completeness`. בדיקת ה-404 דורשת קוד HTTP 404 אמיתי, לא 200 שמגיש מעטפת אפליקציה. הדוחות כוללים גם מסע סוכן שנצפה בפועל, שמוצג בנפרד מהציון המספרי כי משימה אחת לא מייצגת כל סוכן, ומנגנון "Prompt to fix" שהופך המלצות מעשיות לבריף יישום עבור סוכן קוד.

ממשקי מכונה ומגבלות

שלושה משטחים לקריאה בלבד חושפים דוחות שהושלמו: API דוחות ב-`/api/v1/report` עם הגבלת קצב של 120 בקשות לכתובת IP בחלון של 60 שניות, שגיאות בפורמט RFC 9457 עם קודי שגיאה יציבים כמו `invalid_url` ו-`report_not_found`, וכן שרת MCP ו-CLI. הכלי מכוון לכל ארגון שמחזיק משטח ווב ציבורי, מסטארטאפים בשלב סיד שמקבלים ביקורת בסיס ללא רכש, דרך צוותי SaaS שמחברים את פלט ה-JSON ל-CI כשער רגרסיה, ועד ארגונים שמבצעים בנצ'מרק לפורטלי תיעוד, אתרי מפתחים ומשטחי מסחר ביחידות עסקיות שונות. מקרי שימוש כוללים ביקורות טרום-השקה, בדיקות CI שנכשלות כשתוכן מרונדר-שרת נסוג, בנצ'מרק תחרותי מול ציונים פומביים, אימות ששרת MCP או משטח OpenAPI אכן ניתן לגילוי, ותעדוף תיקונים טכניים עם פרומפטים מוכנים להעתקה.

מקור: marktechpost.com