דילוג לתוכן הראשי

Meta משחררת את Muse Glimmer: סוכן AI פתוח שרץ על GPU ביתי

Meta חוזרת לקוד פתוח עם Muse Glimmer: מודל סוכנים בן 30 מיליארד פרמטרים ברישיון Apache 2.0 שרץ על GPU צרכני יחיד, גם בלי אינטרנט. מה זה אומר למפתחים בישראל.

יעל ברנעיעל ברנעעורכת ראשית
·5 דק׳ קריאה·1 צפיות
0:00 / 4:24
מחשב עם כרטיס מסך צרכני חשוף מריץ מודל שפה מקומי בחדר עבודה ביתי

Meta Superintelligence Labs שחררה ב-10 באוגוסט את Muse Glimmer, מודל בן 30 מיליארד פרמטרים שנבנה במיוחד לעבודת סוכנים מקומית: function calling, קידוד וסשנים ארוכים של שימוש בכלים. המשקולות פתוחות ברישיון Apache 2.0, והמודל רץ על Mac או PC עם GPU צרכני יחיד, גם בלי חיבור לאינטרנט. אחרי חודשים שבהם נראה היה ש-Meta נטשה את עולם הקוד הפתוח, זו הפתעה של ממש למפתחים.

מה בדיוק שוחרר, ואיך זה נכנס ל-24GB

מודל בסדר גודל של 30 מיליארד פרמטרים דורש בדרך כלל יותר מ-55GB זיכרון בדיוק מלא, נתון שמוציא מהמשחק כל חומרה ביתית. כדי לפתור את זה, Meta פרסמה לצד המשקולות המלאות גם גרסאות קוונטיזציה של כ-4 ביט, שמכווצות את המודל לפחות מ-20GB. התוצאה: המודל כולו, כולל מקום לקונטקסט של סשן עבודה, נכנס במעטפת זיכרון של 24GB או 32GB, כלומר כרטיס GPU צרכני חזק אחד או Mac עם זיכרון מאוחד מתאים.

בניגוד למודלים כלליים שמותאמים בדיעבד לשימוש בכלים, Glimmer אומן מהיסוד סביב תרחישי סוכנות: קריאות לפונקציות, כתיבת קוד מקומית, וסשנים ארוכים שבהם המודל מתכנן, מריץ כלים, בודק תוצאות ומתקן את עצמו. זה הופך אותו למועמד טבעי להיות המנוע של סוכנים אוטונומיים שרצים כולם על המכונה של המשתמש.

שינוי כיוון: החזרה של Meta לקוד פתוח

ההקשר כאן חשוב לא פחות מהמפרט הטכני. באפריל 2026 החליפה Meta את משפחת Llama הפתוחה במודל הקנייני Muse Spark, מהלך שרבים בקהילה פירשו כסוף עידן המשקולות הפתוחות של החברה. Muse Glimmer הוא השחרור הפתוח המלא הראשון שלה מאז, והבחירה ברישיון Apache 2.0, המתירני מבין הרישיונות הנפוצים, משדרת כוונה ברורה: Meta רוצה שהמודל ירוץ בכל מקום, כולל במוצרים מסחריים, בלי תנאים מגבילים.

שחרור פתוח של מודל סוכנים שרץ על כרטיס אחד משנה את חישוב העלויות של כל מי שבנה עד היום על API בענן. פתאום התקורה השולית של כל משימה היא אפס, וזה פותח שימושים שלא היו כלכליים קודם.
מהנדס תשתיות AI בחברת תוכנה ישראלית

המהלך מגיע גם על רקע צניחת מחירי ההסקה בענן: לפי דוח של בנק ההשקעות ג'פריס מ-10 באוגוסט, המצטט נתוני Silicon Data, העלות הממוצעת לעיבוד בקשות עמדה בתחילת אוגוסט על 1.16 עד 1.18 דולר בלבד למיליון טוקנים. כשהענן זול כל כך, מודל פתוח שרץ מקומית חייב להציע ערך אחר, ו-Meta מהמרת שהערך הזה הוא פרטיות, שליטה וזמינות ללא תלות ברשת.

מהנדסת בחדר שרתים קטן של ארגון מחברת תחנת עבודה מקומית לארון תקשורת
הרצה מקומית של מודלים הופכת לאופציה מעשית גם לארגונים שלא יכולים לשלוח נתונים לענן

למה זה חשוב דווקא לישראלים

האקוסיסטם הישראלי בנוי ברובו מסטארטאפים קטנים, מפתחים עצמאיים וצוותי פיתוח רזים, בדיוק הקהל שמודל כזה משרת. אבל הזווית המשמעותית ביותר היא ריבונות נתונים: ארגונים ישראליים בתחומי הביטחון, הבריאות והפיננסים כפופים למגבלות שאוסרות או מקשות על שליחת מידע רגיש לענן ציבורי. סוכן AI שרץ כולו על חומרה מקומית, בלי שאף טוקן עוזב את הארגון, פותר את הבעיה הזאת מהשורש.

  • מפתחים עצמאיים: סוכן קידוד מקומי שרץ על תחנת העבודה, בלי חיוב לפי טוקנים ובלי מגבלות קצב.
  • סטארטאפים: אב-טיפוס של מוצר מבוסס סוכנים בעלות חומרה חד-פעמית, עם רישיון Apache 2.0 שמאפשר שימוש מסחרי חופשי.
  • ארגונים רגישים: אוטומציה על מסמכים ומערכות פנימיות כשהנתונים לא יוצאים מהרשת הארגונית, כולל בסביבות מנותקות לגמרי מהאינטרנט.
  • חברות בפריפריית הענן: זמינות מלאה גם כשאין קישוריות יציבה, למשל בשטח או במתקנים מאובטחים.

מתכננים לנסות את Muse Glimmer מקומית? ודאו שיש לכם לפחות 24GB זיכרון GPU (או זיכרון מאוחד ב-Mac) והתחילו מגרסת הקוונטיזציה של 4 ביט. המשקולות המלאות רלוונטיות בעיקר למי שמריץ על שרתים או מתכנן fine-tuning.

מה זה עושה לשוק הסוכנים

עד היום, בניית סוכן אוטונומי רציני חייבה כמעט תמיד תלות ב-API של ספק ענן, עם כל המשתמע: עלות משתנה, תלות בזמינות השירות, ושליחת כל פיסת מידע החוצה. Glimmer מוריד דרמטית את חסם הכניסה. סוכן שמסכם דוחות, מנהל קבצים, כותב קוד ומריץ בדיקות יכול עכשיו לפעול על לפטופ, וזה משנה את מבנה התמריצים של כל השוק: ספקי הענן יצטרכו להצדיק את הפרמיה שלהם ביכולות שמודל מקומי של 30 מיליארד פרמטרים לא מספק.

בשילוב עם מלחמת המחירים בענן, מסתמנת תמונה שבה עלות האינטליגנציה עצמה מפסיקה להיות צוואר הבקבוק. השאלה עוברת לשכבות שמעל: מי בונה את הכלים, האינטגרציות ומנגנוני הבטיחות שהופכים מודל חזק לסוכן אמין. ולחברות ישראליות שמתמחות בדיוק בשכבות האלה, זו הזדמנות.

מה הלאה

בשבועות הקרובים כדאי לעקוב אחרי שלושה דברים: כמה מהר הקהילה תוציא גרסאות fine-tuning ייעודיות, כולל התאמות לעברית; האם Meta תמשיך בקו הפתוח עם מודלים נוספים במשפחת Muse או שמדובר בשחרור חד-פעמי; ואיך יגיבו המתחרות, שעד כה שמרו את מודלי הסוכנים החזקים שלהן מאחורי API. אם Glimmer יתפוס, סביר שנראה גל של שחרורים פתוחים בקטגוריית הסוכנים המקומיים. למפתחים בישראל, בכל מקרה, נפתחה עכשיו דלת ששווה להיכנס בה.

שאלות נפוצות

מה זה Muse Glimmer של Meta?

Muse Glimmer הוא מודל שפה בן 30 מיליארד פרמטרים ש-Meta שחררה ב-10 באוגוסט 2026 עם משקולות פתוחות ברישיון Apache 2.0. הוא נבנה במיוחד לעבודת סוכנים מקומית: function calling, קידוד וסשנים ארוכים של שימוש בכלים, והוא פועל גם ללא חיבור לאינטרנט.

איזו חומרה צריך כדי להריץ את Muse Glimmer מקומית?

בזכות גרסאות קוונטיזציה של כ-4 ביט, המודל מתכווץ לפחות מ-20GB ונכנס במעטפת זיכרון של 24GB או 32GB. בפועל מספיק PC עם GPU צרכני יחיד עם 24GB זיכרון, או Mac עם זיכרון מאוחד מתאים.

האם מותר להשתמש ב-Muse Glimmer למוצר מסחרי?

כן. המודל שוחרר ברישיון Apache 2.0, אחד הרישיונות המתירניים ביותר, שמאפשר שימוש מסחרי, שינוי והפצה ללא תמלוגים. זה הופך אותו למתאים גם לסטארטאפים שבונים עליו מוצרים.

#Meta#Muse Glimmer#מודלים פתוחים#סוכני AI#קוונטיזציה#הרצה מקומית
מה דעתכם?

דרגו את הכתבה

הדירוג עוזר לנו לדעת מה שווה לכם.

תגובות

התגובה חייבת להיות בעברית ומתפרסמת מיד.
  1. היו הראשונים להגיב.

עוד בנושא