21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
מודלים

קיוון משיקה את Qwen-Image-2.1, מודל 7B פתוח משקלים שמאחד יצירה ועריכה בחבילה קלה

קיוון משיקה את Qwen-Image-2.1, מודל 7B פתוח משקלים שמאחד יצירה ועריכה בחבילה קלה

מודל אחד לשני תפקידים

צוות קיוון (Qwen) של עליבאבא שחרר את Qwen-Image-2.1, הגרסה החדשה בסדרת מודלי התמונה של החברה. המודל מגיע בארכיטקטורת 7 מיליארד פרמטרים בלבד, קומפקטית במונחים של התחום, ומיועד לשמש גם כגנרטור וגם כעורך תמונות במודל מאוחד אחד. לדברי המפתחים, הגישה המאוחדת מאפשרת איכות גבוהה באריזה קלה, בלי להחזיק שני מודלים נפרדים למשימות שונות.

מהירות ומשקל נמוך מול סגורים

לפי נתוני החברה, הארכיטקטורה הקלה מספקת הסקת מסקנות (inference) מהירה במיוחד כשמדובר בכניסות מרובות תמונות, ועוקפת בביצועים את רוב המודלים הסגורים המקבילים. המשקלים זמינים להורדה ב־GitHub, במודל סקופ (Model Scope) ובהאגינג פייס (Hugging Face), מה שמאפשר למפתחים להריץ את המודל מקומית או לשלב אותו בפייפליינים קיימים בלי תלות ב-API חיצוני.

שקיפות מקורית ועריכה מרובת רפרנסים

היכולת הבולטת ביותר היא תמיכה מקורית בשכבות RGBA, המודל מייצר ועורך שקיפות ישירות, בלי צורך במסכות נפרדות או שלבי פוסט-פרוססינג. זה מקל על קומפוזיטינג חלק ועריכת טקסט בתוך תמונות שקופות. בנוסף, המודל מקבל עד עשר תמונות רפרנס בו-זמנית ושומר על נאמנות גבוהה בפרטים מקומיים, בדגש על פורטרטים ומוצרים, נקודת תורפה ידועה במודלים קודמים.

כיסוי רחב: פנורמות, אינפוגרפיקות ומדידות וירטואליות

קיוון מדווחת שהמודל מצטיין בשלושה תרחישים תובעניים: פנורמות רחבות, אינפוגרפיקות עם טיפוגרפיה אלגנטית, ומדידות וירטואליות (virtual try-on) עם טקסטורות ריאליסטיות. השילוב בין שליטה מקומית מדויקת לשמירה על קוהרנטיות גלובלית מאפשר תוצאות שמתקרבות לאיכות של כלי עריכה מקצועיים, לפחות בתנאי הבדיקה של החברה.

מה חסר בהכרזה

הבלוג הרשמי והמאגרים לא מפרסמים מדדי ביצועים כמותיים מול מתחרים ספציפיים (כמו Flux, Midjourney v6 או gpt-image-1), ואין התייחסות למגבלות ידועות, למשל התמודדות עם טקסט ארוך בעברית או ערבית, או עקביות זהות בדמויות לאורך סדרת תמונות. גם רישיון השימוש המדויק לא מופיע בהודעה הקצרה, וצריך לבדוק את הקבצים במאגרים לפני הטמעה מסחרית.

זמינות מיידית למפתחים

המשקלים הפתוחים זמינים כבר עכשיו בכל הפלטפורמות שצוינו, עם דוגמאות קוד בסיסיות בגיטהאב. מי שמחפש מודל תמונה קל-משקל שמכסה גם יצירה וגם עריכה, בלי לשלם על קריאות API, ימצא כאן נקודת התחלה מעשית, בתנאי שיבדוק את הרישיון ואת ההתאמה לשפות ולמשימות הספציפיות שלו.