דילוג לתוכן הראשי

Qwen3.8 27B ברישיון Apache: מודל חזק להרצה מקומית וחופשי לשימוש מסחרי

עליבאבא שחררה את Qwen3.8-Max-0902 לצד גרסת 27B מזוקקת ברישיון Apache. מה זה אומר למפתחים ולעסקים בישראל שרוצים להריץ מודל חזק מקומית?

נועה שגבנועה שגבכתבת מחקר
·4 דק׳ קריאה·1 צפיות
0:00 / 6:47
שרת GPU בחדר שרתים של סטארטאפ, עם יד של מפתח מחברת כבל רשת

עליבאבא שחררה ב-2 בספטמבר 2026 שני מודלים חדשים במשפחת Qwen3.8: גרסת דגל מעודכנת בשם Qwen3.8-Max-0902, ולצידה גרסה מזוקקת של 27 מיליארד פרמטרים. החדשות האמיתיות מסתתרות דווקא במודל הקטן: Qwen3.8 27B משוחרר תחת רישיון Apache המתירני, מה שהופך אותו לאחת האופציות המעניינות ביותר כרגע למי שרוצה מודל חזק שרץ מקומית וחופשי לשימוש מסחרי בלי אותיות קטנות.

מה בדיוק שוחרר: הענק והגרסה המזוקקת

משפחת Qwen3.8 היא ליגת הכבדים של המודלים הפתוחים: מודל של 2.4 טריליון פרמטרים, שנכון לאוגוסט 2026 היה המודל הפתוח השני בגודלו ובעוצמתו, אחרי Kimi K3 בלבד. Qwen3.8-Max-0902 הוא רענון של אותו מודל דגל, מהסוג שעליבאבא נוהגת לשחרר כדי לשמור על קצב מול המתחרים הסיניים והאמריקאיים.

אבל מודל של טריליוני פרמטרים הוא לא משהו שמריצים על שרת בודד, ובטח לא על מחשב עבודה. כאן נכנסת לתמונה גרסת ה-27B: מודל מזוקק (distilled) שנועד ללכוד כמה שיותר מהיכולות של האח הגדול בגודל שאפשר להריץ על חומרה נגישה. שחרור שתי הגרסאות באותו יום הוא הצהרת כוונות ברורה: עליבאבא רוצה להיות גם בקצה העליון של הביצועים וגם על המחשבים של המפתחים.

למה רישיון Apache הוא הסיפור האמיתי

בעולם המודלים הפתוחים, המילה "פתוח" מכסה טווח רחב של רישיונות. חלק מהמודלים משוחררים תחת רישיונות מותאמים אישית שמגבילים שימוש מסחרי, אוסרים על אימון מודלים מתחרים, או דורשים הסכמים נפרדים מעל סף מסוים של משתמשים. רישיון Apache, לעומת זאת, הוא מהמתירניים שקיימים: מותר להשתמש, לשנות, לעשות fine-tuning, להטמיע במוצר מסחרי ולמכור, בלי לבקש רשות ובלי לשלם תמלוגים.

ההבדל בין רישיון פתוח אמיתי לרישיון 'פתוח עם כוכבית' הוא ההבדל בין לבנות מוצר לבין לבנות מוצר שעורך הדין של החברה יאשר. Apache על מודל בסדר גודל כזה משנה את החישוב לכל צוות שבונה על מודלים מקומיים.
גורם בתעשיית התוכנה הישראלית

כשמצרפים לזה את העובדה ש-27 מיליארד פרמטרים הוא גודל שאפשר להריץ בקוונטיזציה על תחנת עבודה עם GPU יחיד חזק, או על שרת צנוע יחסית, מתקבל שילוב נדיר: מודל שמגיע ממשפחה שנמצאת בצמרת המודלים הפתוחים, בגודל פרקטי, עם רישיון שלא מייצר סיכון משפטי.

מפתחת יושבת מול שני מסכים במשרד, על אחד מהם רץ טרמינל עם תהליך הורדת קבצים גדולים
מודלים בסדר גודל של 27B הפכו לנקודת האיזון בין ביצועים לעלות הרצה מקומית

הזווית הישראלית: מי צריך את זה כאן

בישראל יש שלוש קבוצות שצריכות לשים לב לשחרור הזה. הראשונה היא ארגונים עם דרישות רגולציה ופרטיות מחמירות: גופים ביטחוניים, בתי חולים, בנקים וחברות ביטוח, שלא יכולים או לא רוצים לשלוח מידע רגיש ל-API בענן. מודל חזק שרץ כולו על תשתית מקומית, בלי שנתון אחד יוצא מהארגון, פותר את הבעיה מהשורש.

הקבוצה השנייה היא סטארטאפים שמריצים נפחי inference גבוהים. עלויות API של מודלי דגל מסחריים יכולות להגיע לעשרות אלפי דולרים בחודש בקנה מידה. מודל 27B בבעלות מלאה, שאפשר גם לעשות לו fine-tuning על דאטה פנימי, הופך את מבנה העלויות מהוצאה משתנה לתשתית קבועה. הקבוצה השלישית היא חוקרים ואקדמיה: גרסה מזוקקת של מודל מוביל היא חומר גלם מצוין למחקר על דיסטילציה, alignment ו-quantization.

  • ארגונים רגישים לפרטיות: הרצה מקומית מלאה בלי שדאטה עוזב את הרשת הארגונית
  • סטארטאפים עתירי inference: החלפת עלות API משתנה בתשתית בבעלות מלאה
  • צוותי מוצר: fine-tuning חופשי על דאטה קנייני, כולל בעברית, בלי מגבלות רישוי
  • חוקרים: בסיס פתוח לניסויים בדיסטילציה, קוונטיזציה והתאמת דומיין

לפני שמטמיעים מודל פתוח בפרודקשן, כדאי לבדוק את ביצועיו בעברית על המשימות הספציפיות שלכם. מודלים ממשפחת Qwen מאומנים על דאטה רב-לשוני, אבל איכות בעברית משתנה בין גרסאות ומשימות, ובנצ'מרק פנימי קטן חוסך הפתעות.

התמונה הגדולה: המרוץ הפתוח עובר דרך סין

השחרור הזה מחדד מגמה שנמשכת כבר תקופה: הקצה העליון של המודלים הפתוחים נשלט היום על ידי שחקניות סיניות. Kimi K3 מוביל, משפחת Qwen3.8 מיד אחריו, ועליבאבא ממשיכה לשחרר גרסאות מזוקקות בקצב גבוה. עבור חברות אמריקאיות ואירופיות שבנו אסטרטגיה סביב מודלים סגורים, זהו לחץ תחרותי מתמשך; עבור קהילת הקוד הפתוח, זו תקופה של שפע חסר תקדים.

יש גם צד שדורש שיקול דעת: ארגונים מסוימים, בעיקר בסקטור הביטחוני, ירצו לבחון מקרוב מודל שמקורו בסין לפני הטמעה, גם כשהמשקולות פתוחות לחלוטין וניתנות לבדיקה. היתרון של משקולות פתוחות הוא בדיוק זה: אפשר להריץ אותן בסביבה מבודדת, לבדוק התנהגות, ולא להיות תלויים בשרתים של אף אחד.

מה הלאה

בשבועות הקרובים צפויים להופיע הדברים הרגילים שמלווים כל שחרור פתוח משמעותי: גרסאות קוונטיזציה קהילתיות שיאפשרו הרצה על חומרה צנועה עוד יותר, השוואות ביצועים מול מודלים פתוחים מתחרים, וגרסאות fine-tuned לדומיינים ספציפיים. למפתחים בישראל, ההמלצה הפרקטית היא פשוטה: להוריד, להריץ על סט הבדיקות הפנימי, ולראות אם המספרים מצדיקים מעבר. כשהרישיון הוא Apache, המחיר של הניסוי הוא בעיקר זמן.

שאלות נפוצות

מה ההבדל בין Qwen3.8-Max-0902 לגרסת ה-27B?

Qwen3.8-Max-0902 הוא רענון של מודל הדגל הענק במשפחת Qwen3.8 (2.4 טריליון פרמטרים), בעוד גרסת ה-27B היא מודל מזוקק וקטן שנועד להרצה מקומית. שניהם שוחררו ב-2 בספטמבר 2026, אבל רק גרסת ה-27B משוחררת ברישיון Apache המתירני.

האם מותר להשתמש ב-Qwen3.8 27B למטרות מסחריות?

כן. המודל משוחרר תחת רישיון Apache, שמתיר שימוש מסחרי חופשי, שינוי, fine-tuning והטמעה במוצרים בתשלום, בלי תמלוגים ובלי צורך בהסכם נפרד עם עליבאבא.

איזו חומרה צריך כדי להריץ מודל של 27 מיליארד פרמטרים מקומית?

בקוונטיזציה מקובלת, מודל בסדר גודל של 27B ניתן להרצה על תחנת עבודה עם GPU יחיד חזק בעל זיכרון גבוה, או על שרת עם מספר כרטיסים צנועים. ככל שרמת הקוונטיזציה אגרסיבית יותר, דרישות הזיכרון יורדות על חשבון מעט דיוק.

#Qwen3.8#עליבאבא#מודלים פתוחים#רישיון Apache#הרצה מקומית#דיסטילציה
מה דעתכם?

דרגו את הכתבה

הדירוג עוזר לנו לדעת מה שווה לכם.

תגובות

התגובה חייבת להיות בעברית ומתפרסמת מיד.
  1. היו הראשונים להגיב.

עוד בנושא