21 בספטמבר 2026 האקדמיה ארכיון
מבזקים
עליבאבא משיקה את Qwen-Image-2.1: מודל 7B מאוחד לייצור ועריכת תמונות ארה"ב וסין פתחו בדיאלוג על התראות ביטחוניות בבינה מלאכותית החומה הווירטואלית לא עוצרת אף אחד, רק סופרת גופות מרכז בטיחות הבינה המלאכותית חושף: כל מודלי החזית מרמים בבנצ'מרק חדש NVIDIA משיקה את Halos, מערכת בטיחות מלאה ל-Physical AI
מודלים

Qwen 27B מסמן רגע "דיפסיק" לקוד פתוח ורץ על RTX 5090 בודד

Qwen 27B מסמן רגע "דיפסיק" לקוד פתוח ורץ על RTX 5090 בודד

הטענה והמספרים

המשתמש Chubby ב-X מגדיר את Qwen 27B כרגע "דיפסיק" לקוד הפתוח, מודל שמגיע לביצועים של מודלים סגורים מלפני חודשים ספורים ורץ מקומית על כרטיס RTX 5090 יחיד. לדבריו, המודל משתווה ל-GPT-5.6 Luna במבחני Artificial Analysis, כשהמשמעות המעשית היא חיסכון בעלויות הסקה מול גישה לענן.

כלכלת החומרה מול הענן

כרטיס RTX 5090 נמכר כיום בכ-4,500 דולר (כ-16,650 שקל) בגלל ביקוש שעולה על ההיצע. לפי החישוב שהציג Chubby, עלות משימה ב-Luna עומדת על 0.05 דולר, כך שרכישת הכרטיס שקולה לכ-90 אלף משימות, או כ-60 משימות ביום במשך ארבע שנים רצופות. המספרים האלה מניחים זמינות מלאה של החומרה ואפס עלויות חשמל ותחזוקה.

המגבלה המעשית: זיכרון

בתגובות לשרשור עלתה בעיה מוכרת: אותו זיכרון וידאו שנדרש ל-Qwen 27B משמש גם את Codex וסביבות פיתוח מקבילות. מי שמריץ כמה כלים במקביל עלול לגלות שאין מספיק VRAM לכל הצרכים, מה שהופך את ההבטחה "רץ על 5090" לתלויה בתצורת העבודה הספציפית.

הסף האמיתי: "מספיק טוב" מול ניצחון בבנצ'מרקים

הטיעון המרכזי שעולה מהדיון הוא שמודלים מקומיים לא צריכים לנצח בכל מבחן, הם צריכים להיות "מספיק טובים" כדי שפרטיות ושליטה מלאה יצדיקו את הוויתור על נוחות הענן. Qwen 27B, לפי Chubby, עובר את הסף הזה. עם זאת, ההשוואה ל-Luna מתבססת על מבחן בודד של Artificial Analysis ולא על הערכה עצמאית רחבה, והביצועים בפועל עשויים להשתנות לפי סוג המשימה וההגדרות.