דילוג לתוכן הראשי

Qwen 3.8 27B בקוד פתוח: מולטימודלי עם הקשר של 262K טוקנים

עליבאבא שחררה את Qwen 3.8 27B ברישיון Apache 2.0: מודל מולטימודלי קומפקטי עם חלון הקשר של 262K טוקנים שרץ מקומית. מה זה אומר למפתחים בישראל.

יעל ברנעיעל ברנעעורכת ראשית
·4 דק׳ קריאה·1 צפיות
0:00 / 6:31
עמדת עבודה של מפתח עם מחשב מצויד ב-GPU ומסכים המריצים מודל שפה מקומית במשרד סטארטאפ

צוות Qwen של עליבאבא שחרר ב-15 באוגוסט את Qwen 3.8 27B תחת רישיון Apache 2.0, בלי הגבלות שימוש מסחרי ובלי אותיות קטנות. מדובר במודל בן 27 מיליארד פרמטרים עם יכולות ראייה משולבות וחלון הקשר נייטיבי של 262K טוקנים, שניתן להרחבה עד מיליון. השילוב הזה, מודל קומפקטי שרץ על חומרה סבירה ומביא יכולות שעד לא מזמן היו שמורות למודלי דגל סגורים, הופך את השחרור לאחד המעניינים של הקיץ.

מה בדיוק שוחרר, ולמה הארכיטקטורה מעניינת

Qwen 3.8 27B הוא מודל שפה מולטימודלי: הוא מקבל טקסט ותמונות באותו מודל, בלי צורך ברכיב ראייה נפרד. מתחת למכסה המנוע הצוות משלב שתי טכניקות, Gated DeltaNet ו-Gated Attention, שנועדו לאפשר עיבוד של רצפים ארוכים מאוד בעלות חישובית נמוכה משמעותית מ-attention קלאסי. זו הסיבה שחלון הקשר של 262K טוקנים הוא נייטיבי ולא תוצאה של טריקים בזמן הרצה, והוא ניתן להרחבה עד מיליון טוקנים למי שצריך לעבד ספרים שלמים, מאגרי קוד או ארכיוני מסמכים.

הבחירה ב-27 מיליארד פרמטרים אינה מקרית. זה בדיוק הגודל שיושב בנקודה המתוקה בין יכולת לבין נגישות: עם קוונטיזציה סטנדרטית המודל נכנס ל-GPU צרכני חזק או לתחנת עבודה עם זיכרון מאוחד, בלי צורך בשרת עם שמונה כרטיסים. במילים אחרות, סטארטאפ קטן או אפילו מפתח יחיד יכולים להריץ אותו מקומית.

ההקשר: גל המודלים הפתוחים לא נעצר

השחרור מגיע שבועות ספורים אחרי גל שחרורים צפוף שכלל את GLM-5.3 ואת DeepSeek V4 Pro, ומחדד מגמה ברורה: המעבדות הסיניות הפכו את הקוד הפתוח לזירת התחרות המרכזית שלהן מול המודלים הסגורים מארה"ב. אבל בעוד שרוב השחרורים הקודמים התמקדו במודלים גדולים שדורשים תשתית כבדה, Qwen 3.8 27B תוקף מהכיוון ההפוך: מקסימום יכולת במינימום חומרה.

הסיפור האמיתי כאן הוא לא עוד מודל פתוח, אלא הצטמצמות הפער בין מה שרץ אצלך על השולחן לבין מה שיושב מאחורי API בענן. כשמודל של 27 מיליארד פרמטרים נותן חלון הקשר של רבע מיליון טוקנים עם ראייה, חלק מהסיבות לשלם למודל סגור פשוט נעלמות.
מהנדס בינה מלאכותית בחברת תוכנה ישראלית
ארון שרתים קומפקטי עם כרטיסי מסך בחדר שרתים קטן של חברת סטארטאפ
מודלים קומפקטיים בקוד פתוח מאפשרים לחברות קטנות להקים תשתית inference עצמאית בלי חוות שרתים

למה זה משנה למפתחים ולעסקים בישראל

בשוק הישראלי יש שלוש קבוצות שצריכות לשים לב לשחרור הזה. הראשונה היא ארגונים עם דרישות פרטיות מחמירות, גופים ביטחוניים, בתי חולים, מוסדות פיננסיים, שלא יכולים לשלוח נתונים ל-API חיצוני. מודל מולטימודלי ברישיון Apache 2.0 שרץ בתוך הרשת הארגונית פותר להם את הבעיה מהשורש. השנייה היא סטארטאפים בשלבים מוקדמים, שעבורם עלויות ה-API של מודלים סגורים הן סעיף הוצאה כבד: הרצה מקומית או על שרת GPU שכור הופכת את מבנה העלויות מצריכה משתנה לעלות קבועה וצפויה.

הקבוצה השלישית היא מי שבונה מוצרים סביב מסמכים ארוכים. חלון הקשר של 262K טוקנים מספיק לחוזה משפטי שלם עם נספחים, לתיק רפואי מלא או לריפוזיטורי קוד בינוני, בלי pipeline של RAG מורכב. יכולת הראייה המשולבת מוסיפה עיבוד של טבלאות סרוקות, קבלות ותרשימים באותה קריאה.

  • רישיון Apache 2.0: שימוש מסחרי חופשי, כולל fine-tuning והטמעה במוצר בלי תמלוגים
  • חלון הקשר נייטיבי של 262K טוקנים, ניתן להרחבה עד מיליון
  • מולטימודליות מובנית: טקסט ותמונות במודל אחד
  • גודל של 27 מיליארד פרמטרים שמאפשר הרצה על תחנת עבודה חזקה עם קוונטיזציה
  • ארכיטקטורת Gated DeltaNet ו-Gated Attention לעיבוד יעיל של רצפים ארוכים

לפני שמטמיעים את המודל במוצר, כדאי להריץ עליו את מערך ההערכה הפנימי שלכם בעברית. מודלים פתוחים ממקור סיני מתאמנים בעיקר על אנגלית וסינית, וביצועים בעברית עשויים לדרוש fine-tuning ייעודי או שכבת תרגום.

הזווית הגיאופוליטית: עצמאות מ-API אמריקאי

יש כאן גם ממד אסטרטגי רחב יותר. ככל שעליבאבא ומעבדות סיניות נוספות משחררות מודלים חזקים בחינם, הן מכרסמות במודל העסקי של ספקיות ה-API האמריקאיות בשווקים שמחוץ לארה"ב. עבור חברות ישראליות שמוכרות ללקוחות באירופה ובאסיה, היכולת להציע פריסה מקומית של מודל פתוח היא לעיתים תנאי סף רגולטורי, במיוחד תחת דרישות ריבונות נתונים באיחוד האירופי. Qwen 3.8 27B מצטרף לארגז הכלים הזה בדיוק בגודל הנכון.

מה הלאה

כמו בכל שחרור פתוח, השבועות הקרובים יקבעו את גורל המודל: כמה מהר תגיע תמיכה מלאה בכלי ההרצה הפופולריים, כמה גרסאות קוונטיזציה איכותיות יעלו לקהילה, והאם המדדים העצמאיים יאשרו את ההבטחות. אם התבנית של שחרורי Qwen קודמים תחזור על עצמה, סביר שנראה גם גרסאות בגדלים נוספים ו-fine-tunes קהילתיים, כולל כאלה שמותאמים לעברית, בתוך שבועות. למפתחים בארץ זו הזדמנות טובה להוריד, למדוד ולהחליט על בסיס נתונים ולא על בסיס הייפ.

שאלות נפוצות

האם מותר להשתמש ב-Qwen 3.8 27B למטרות מסחריות?

כן. המודל שוחרר תחת רישיון Apache 2.0, שמתיר שימוש מסחרי מלא, כולל fine-tuning, שינוי והטמעה במוצרים, בלי תשלום תמלוגים ובלי צורך באישור מעליבאבא.

איזו חומרה צריך כדי להריץ את Qwen 3.8 27B מקומית?

מדובר במודל של 27 מיליארד פרמטרים, כך שעם קוונטיזציה סטנדרטית הוא יכול לרוץ על GPU צרכני חזק או תחנת עבודה עם זיכרון מאוחד גדול. להרצה בדיוק מלא או עם חלון הקשר מקסימלי יידרש שרת GPU חזק יותר.

מה גודל חלון ההקשר של Qwen 3.8 27B?

חלון ההקשר הנייטיבי הוא 262K טוקנים, והוא ניתן להרחבה עד מיליון טוקנים. זה מספיק לעיבוד מסמכים ארוכים מאוד, מאגרי קוד או ארכיונים שלמים בקריאה אחת.

#Qwen 3.8#עליבאבא#מודלים בקוד פתוח#Apache 2.0#הרצה מקומית#Gated DeltaNet
מה דעתכם?

דרגו את הכתבה

הדירוג עוזר לנו לדעת מה שווה לכם.

תגובות

התגובה חייבת להיות בעברית ומתפרסמת מיד.
  1. היו הראשונים להגיב.

עוד בנושא