13 באוגוסט 2026 האקדמיה ארכיון
מבזקים
אפליקציית ChatGPT שולחנית ללינוקס יוצאת בתצוגה מקדימה עם קודקס מובנה DeepSeek-V4-Pro מגיע למקום 8 בקוד ארנה, שני בין המודלים הפתוחים דינה רובוטיקס משחררת מודל עולם-פעולה שפותח על מיליון שעות וידאו אנושי נמוטרון 3.5 לייטנינג נוחת בפריים אינטלקט עם תמיכה מיום אפס התפרצות כבד שומני עולמית: בינה מלאכותית עשויה להקדים תרופה למכה
מודלים

בינה מלאכותית: ג'יפט אימג' 2 שולט בקטגוריות החדשות של אנליזה מלאכותית

מאת רותם ברנע כתב/ת AgentNet
בינה מלאכותית: ג'יפט אימג' 2 שולט בקטגוריות החדשות של אנליזה מלאכותית

המתודולוגיה התרחבה

אנליזה מלאכותית הרחיבה את זירת הטקסט-לתמונה שלה והוסיפה שני תרחישי שימוש, עיצוב UI/UX וסרטי לייב-אקשן, לצד שתי יכולות מדידה: פיזיקה ורינדור טקסט. השינוי מעביר את ההשוואה מדירוג כללי יחיד לפילוח לפי משימות קונקרטיות, וממקם את GPT Image 2 של OpenAI בראש שלוש מתוך ארבע הקטגוריות החדשות.

עיצוב ממשקים: תיקו בצמרת

בקטגוריית UI/UX, שכוללת מוקאפים לאפליקציות, רכב, מרחב מרחבי, דשבורדים, אייקונים ונכסי מערכות עיצוב, GPT Image 2 ו-Reve 2.1 חולקים את המקום הראשון. Nano Banana 2 מדורג שלישי ומסומן כבחירת הערך הטובה ביותר (best value), כלומר יחס עלות-תועלת עדיף למי שמוכן לוותר על הפסגה המוחלטת.

קולנוע: יתרון לג'יפט אימג' 2

בתרחיש Live-Action Film, סצנות קולנועיות פוטוריאליסטיות, סטוריבורדים ודפי דמויות, GPT Image 2 מוביל בפער, אחריו Nano Banana Pro ובמקום השלישי Reve 2.1. כאן אין תיקו: המודל של OpenAI מציג עליונות ברורה בייצור פריימים שנראים כמו צילום אמיתי.

פיזיקה וטקסט: פערים במחיר ובאיכות

במבחן פיזיקה (כבידה, תמיכה, התנגשות, שינויי מצב וטמפרטורה) GPT Image 2 ראשון, GPT Image 1.5 שני, ו-Nano Banana 2 שלישי וזול מכולם. ברינדור טקסט, טקסט ארוך, קטן, סמלים ואותיות אמנותיות, GPT Image 2 שוב ראשון, Reve 2.1 שני, ו-Nano Banana 2 מציע את הערך הטוב ביותר בשלישייה המובילה: 67 דולר (כ-248 שקל) לאלף תמונות, מול 211 דולר (כ-781 שקל) ו-200 דולר (כ-740 שקל) של שני המתחרים. הפער באיכות כאן הוא הרחב ביותר שנמדד: 178 נקודות Elo בין המודל הטוב לחלש מבין העשרה שנבדקו.

שקיפות ושינוי גישה

המתודולוגיה המלאה, איך נכתבות ההנחיות, איך הן מתרעננות ויוצאות משימוש, ואיך מחושב הציון, מפורסמת באתר. הגישה החדשה משקפת הכרה בכך שדירוג יחיד כבר לא מספיק: מפתחים ומעצבים צריכים לדעת איזה מודל מתאים למשימה הספציפית שלהם, וכמה זה יעלה להם בקנה מידה מסחרי.