Qwen 3.8 27B בקוד פתוח: מולטימודלי עם הקשר של 262K טוקנים
עליבאבא שחררה את Qwen 3.8 27B ברישיון Apache 2.0: מודל מולטימודלי קומפקטי עם חלון הקשר של 262K טוקנים שרץ מקומית. מה זה אומר למפתחים בישראל.

צוות Qwen של עליבאבא שחרר ב-15 באוגוסט את Qwen 3.8 27B תחת רישיון Apache 2.0, בלי הגבלות שימוש מסחרי ובלי אותיות קטנות. מדובר במודל בן 27 מיליארד פרמטרים עם יכולות ראייה משולבות וחלון הקשר נייטיבי של 262K טוקנים, שניתן להרחבה עד מיליון. השילוב הזה, מודל קומפקטי שרץ על חומרה סבירה ומביא יכולות שעד לא מזמן היו שמורות למודלי דגל סגורים, הופך את השחרור לאחד המעניינים של הקיץ.
מה בדיוק שוחרר, ולמה הארכיטקטורה מעניינת
Qwen 3.8 27B הוא מודל שפה מולטימודלי: הוא מקבל טקסט ותמונות באותו מודל, בלי צורך ברכיב ראייה נפרד. מתחת למכסה המנוע הצוות משלב שתי טכניקות, Gated DeltaNet ו-Gated Attention, שנועדו לאפשר עיבוד של רצפים ארוכים מאוד בעלות חישובית נמוכה משמעותית מ-attention קלאסי. זו הסיבה שחלון הקשר של 262K טוקנים הוא נייטיבי ולא תוצאה של טריקים בזמן הרצה, והוא ניתן להרחבה עד מיליון טוקנים למי שצריך לעבד ספרים שלמים, מאגרי קוד או ארכיוני מסמכים.
הבחירה ב-27 מיליארד פרמטרים אינה מקרית. זה בדיוק הגודל שיושב בנקודה המתוקה בין יכולת לבין נגישות: עם קוונטיזציה סטנדרטית המודל נכנס ל-GPU צרכני חזק או לתחנת עבודה עם זיכרון מאוחד, בלי צורך בשרת עם שמונה כרטיסים. במילים אחרות, סטארטאפ קטן או אפילו מפתח יחיד יכולים להריץ אותו מקומית.
ההקשר: גל המודלים הפתוחים לא נעצר
השחרור מגיע שבועות ספורים אחרי גל שחרורים צפוף שכלל את GLM-5.3 ואת DeepSeek V4 Pro, ומחדד מגמה ברורה: המעבדות הסיניות הפכו את הקוד הפתוח לזירת התחרות המרכזית שלהן מול המודלים הסגורים מארה"ב. אבל בעוד שרוב השחרורים הקודמים התמקדו במודלים גדולים שדורשים תשתית כבדה, Qwen 3.8 27B תוקף מהכיוון ההפוך: מקסימום יכולת במינימום חומרה.
הסיפור האמיתי כאן הוא לא עוד מודל פתוח, אלא הצטמצמות הפער בין מה שרץ אצלך על השולחן לבין מה שיושב מאחורי API בענן. כשמודל של 27 מיליארד פרמטרים נותן חלון הקשר של רבע מיליון טוקנים עם ראייה, חלק מהסיבות לשלם למודל סגור פשוט נעלמות.

למה זה משנה למפתחים ולעסקים בישראל
בשוק הישראלי יש שלוש קבוצות שצריכות לשים לב לשחרור הזה. הראשונה היא ארגונים עם דרישות פרטיות מחמירות, גופים ביטחוניים, בתי חולים, מוסדות פיננסיים, שלא יכולים לשלוח נתונים ל-API חיצוני. מודל מולטימודלי ברישיון Apache 2.0 שרץ בתוך הרשת הארגונית פותר להם את הבעיה מהשורש. השנייה היא סטארטאפים בשלבים מוקדמים, שעבורם עלויות ה-API של מודלים סגורים הן סעיף הוצאה כבד: הרצה מקומית או על שרת GPU שכור הופכת את מבנה העלויות מצריכה משתנה לעלות קבועה וצפויה.
הקבוצה השלישית היא מי שבונה מוצרים סביב מסמכים ארוכים. חלון הקשר של 262K טוקנים מספיק לחוזה משפטי שלם עם נספחים, לתיק רפואי מלא או לריפוזיטורי קוד בינוני, בלי pipeline של RAG מורכב. יכולת הראייה המשולבת מוסיפה עיבוד של טבלאות סרוקות, קבלות ותרשימים באותה קריאה.
- רישיון Apache 2.0: שימוש מסחרי חופשי, כולל fine-tuning והטמעה במוצר בלי תמלוגים
- חלון הקשר נייטיבי של 262K טוקנים, ניתן להרחבה עד מיליון
- מולטימודליות מובנית: טקסט ותמונות במודל אחד
- גודל של 27 מיליארד פרמטרים שמאפשר הרצה על תחנת עבודה חזקה עם קוונטיזציה
- ארכיטקטורת Gated DeltaNet ו-Gated Attention לעיבוד יעיל של רצפים ארוכים
לפני שמטמיעים את המודל במוצר, כדאי להריץ עליו את מערך ההערכה הפנימי שלכם בעברית. מודלים פתוחים ממקור סיני מתאמנים בעיקר על אנגלית וסינית, וביצועים בעברית עשויים לדרוש fine-tuning ייעודי או שכבת תרגום.
הזווית הגיאופוליטית: עצמאות מ-API אמריקאי
יש כאן גם ממד אסטרטגי רחב יותר. ככל שעליבאבא ומעבדות סיניות נוספות משחררות מודלים חזקים בחינם, הן מכרסמות במודל העסקי של ספקיות ה-API האמריקאיות בשווקים שמחוץ לארה"ב. עבור חברות ישראליות שמוכרות ללקוחות באירופה ובאסיה, היכולת להציע פריסה מקומית של מודל פתוח היא לעיתים תנאי סף רגולטורי, במיוחד תחת דרישות ריבונות נתונים באיחוד האירופי. Qwen 3.8 27B מצטרף לארגז הכלים הזה בדיוק בגודל הנכון.
מה הלאה
כמו בכל שחרור פתוח, השבועות הקרובים יקבעו את גורל המודל: כמה מהר תגיע תמיכה מלאה בכלי ההרצה הפופולריים, כמה גרסאות קוונטיזציה איכותיות יעלו לקהילה, והאם המדדים העצמאיים יאשרו את ההבטחות. אם התבנית של שחרורי Qwen קודמים תחזור על עצמה, סביר שנראה גם גרסאות בגדלים נוספים ו-fine-tunes קהילתיים, כולל כאלה שמותאמים לעברית, בתוך שבועות. למפתחים בארץ זו הזדמנות טובה להוריד, למדוד ולהחליט על בסיס נתונים ולא על בסיס הייפ.
שאלות נפוצות
האם מותר להשתמש ב-Qwen 3.8 27B למטרות מסחריות?
כן. המודל שוחרר תחת רישיון Apache 2.0, שמתיר שימוש מסחרי מלא, כולל fine-tuning, שינוי והטמעה במוצרים, בלי תשלום תמלוגים ובלי צורך באישור מעליבאבא.
איזו חומרה צריך כדי להריץ את Qwen 3.8 27B מקומית?
מדובר במודל של 27 מיליארד פרמטרים, כך שעם קוונטיזציה סטנדרטית הוא יכול לרוץ על GPU צרכני חזק או תחנת עבודה עם זיכרון מאוחד גדול. להרצה בדיוק מלא או עם חלון הקשר מקסימלי יידרש שרת GPU חזק יותר.
מה גודל חלון ההקשר של Qwen 3.8 27B?
חלון ההקשר הנייטיבי הוא 262K טוקנים, והוא ניתן להרחבה עד מיליון טוקנים. זה מספיק לעיבוד מסמכים ארוכים מאוד, מאגרי קוד או ארכיונים שלמים בקריאה אחת.
דרגו את הכתבה
הדירוג עוזר לנו לדעת מה שווה לכם.



תגובות