דילוג לתוכן הראשי

גל שחרורים ביממה: GLM-5.3, DeepSeek V4 Pro ו-Gemini 3.7 Flash

שלושה מודלים חדשים ב-24 שעות: GLM-5.3 של Z.AI, DeepSeek V4 Pro 0813 ו-Gemini 3.7 Flash. מה מסתתר מאחורי קצב השחרורים ומה זה אומר למפתחים בישראל.

נועה שגבנועה שגבכתבת מחקר
·4 דק׳ קריאה
0:00 / 6:24
טכנאי עובד בין שורות שרתים במרכז נתונים בשעת לילה

שלושה מודלים חדשים בפחות מיממה: GLM-5.3 של Z.AI, DeepSeek V4 Pro 0813 ו-Gemini 3.7 Flash של גוגל. לפי מעקבי השחרורים, אוגוסט 2026 כבר רשם 15 שחרורי מודלים מ-13 ספקים שונים, וקצב כזה לא נראה בתעשייה עד היום. מאחורי המספרים מסתתרת תחרות ישירה בין המעבדות המערביות והסיניות על השכבה הרגישה ביותר בשוק: המודלים המהירים והזולים.

מה שוחרר ב-24 השעות האחרונות

היממה שבין 13 ל-14 באוגוסט הייתה צפופה במיוחד. שלושה שחרורים מאומתים נרשמו בזה אחר זה, כל אחד מהם מכוון לפלח מעט שונה של השוק, אבל כולם נלחמים על אותו קהל: מפתחים שבונים מוצרים ב-scale ומחפשים את היחס הטוב ביותר בין ביצועים למחיר.

  • DeepSeek-V4-Pro-0813: עדכון למודל הדגל של DeepSeek, ששוחרר ב-13 באוגוסט אחרי שהגרסה המרועננת של V4 Flash עקפה אותו במשימות סוכן וקוד
  • GLM-5.3 של Z.AI: הדור הבא בסדרת GLM של המעבדה הסינית, שוחרר ב-14 באוגוסט וממשיך את המסורת של שחרורים פתוחים ותחרותיים
  • Gemini 3.7 Flash: המודל המהיר של גוגל, שמשתפר ב-4 נקודות לעומת Gemini 3.6 Flash במדדי Artificial Analysis

המשותף לשלושתם: אף אחד מהם אינו מודל דגל ענק שמכוון לשיאי benchmark. כולם ממוקמים בשכבת הביניים, זו שבה נסגרות רוב עסקאות ה-API בפועל, כי שם נמצא נפח השימוש האמיתי של אפליקציות בפרודקשן.

הסיפור מאחורי עדכון ה-Pro של DeepSeek

השחרור המעניין ביותר מבין השלושה הוא דווקא V4-Pro-0813, כי הוא נולד ממבוכה פנימית. בסוף יולי DeepSeek אימנה מחדש את V4-Flash, המודל הקטן והזול שלה, עם צנרת אימון משופרת לקוד, סוכנים ושימוש בכלים. התוצאה הפתיעה כנראה גם את החברה עצמה: ה-Flash המעודכן עקף את ה-Pro הגדול והיקר ממנו במשימות סוכן וקוד.

מצב שבו המודל הזול של חברה מנצח את המודל היקר שלה הוא בעיה עסקית מיידית, ולכן עדכון ה-Pro נראה כמו תגובה ישירה לפער הזה. מעבר לדרמה הפנימית, המהלך ממחיש עיקרון שחוזר על עצמו בשנה האחרונה: שיפורי צנרת האימון (data pipeline ו-post-training) מזיזים את המחט לא פחות מהגדלת המודל עצמו.

מה ששובר את השוק זה לא עוד מודל ענק, אלא העובדה שמודלים קטנים ובינוניים סוגרים את הפער במשימות סוכן. כשה-Flash של חברה מנצח את ה-Pro שלה, כל טבלת המחירים של התעשייה נפתחת מחדש למשא ומתן.
גורם בתעשיית ה-AI הישראלית
מפתחת משווה תוצאות של מודלים שונים על שני מסכים במשרד סטארטאפ
השאלה שכל צוות פיתוח שואל השבוע: האם המודל שבחרנו לפני חודש עדיין הבחירה הנכונה?

גוגל לא מוותרת על שכבת ה-Flash

בצד המערבי של המפה, Gemini 3.7 Flash הוא תזכורת לכך שגוגל מתייחסת לשכבת המודלים המהירים כנכס אסטרטגי ולא כמוצר משני. שיפור של 4 נקודות במדדי Artificial Analysis לעומת Gemini 3.6 Flash אולי נשמע צנוע, אבל בשכבה הזו, שבה ההבדלים בין המתחרים קטנים ממילא, קפיצה כזו יכולה להזיז נתחי שוק של ממש.

ההיגיון ברור: רוב הקריאות ל-API בעולם האמיתי הן משימות שגרתיות, כמו סיווג, תמצות, ניתוב בין סוכנים ועיבוד מסמכים. מי ששולט בשכבה הזו שולט בנפח, וגוגל, DeepSeek ו-Z.AI נלחמות עליה בדיוק כי שם נמצא הכסף הגדול לטווח ארוך, גם אם הכותרות הולכות למודלי הדגל.

מה זה אומר למפתחים ולעסקים בישראל

עבור צוותי פיתוח ישראליים, גל השחרורים הזה הוא קודם כל הזדמנות למשא ומתן מחודש עם עצמכם: הבחירה במודל שנעשתה לפני רבעון כנראה כבר לא אופטימלית. סטארטאפ שבנה סוכן על מודל מערבי יקר יכול היום לבדוק ברצינות את GLM-5.3 או את סדרת DeepSeek לחלק מהמשימות, ולשמור את המודלים היקרים רק לצעדים שבאמת דורשים אותם.

אל תנעלו ארכיטקטורה על מודל יחיד. בניית שכבת ניתוב (routing) שמפנה כל משימה למודל הזול ביותר שעומד בה מאפשרת להחליף ספקים תוך ימים במקום חודשים, וזה בדיוק היתרון שקצב השחרורים הנוכחי מעניק למי שערוך אליו.

יש גם צד שדורש זהירות: ארגונים ישראליים בתחומים רגולציה, כמו פיננסים, ביטחון ובריאות, צריכים לשקלל את שאלת מקור המודל. שימוש במודלים סיניים דרך API מעלה שאלות של ריבונות נתונים, בעוד שהרצה מקומית של גרסאות פתוחות (כשהן זמינות) יכולה לנטרל חלק מהחשש. ההחלטה כאן היא לא רק הנדסית אלא גם משפטית ועסקית.

לאן זה הולך מכאן

15 שחרורים מ-13 ספקים בחודש אחד הם לא אנומליה אלא הנורמה החדשה, לפחות כל עוד שיפורי הצנרת ממשיכים להניב קפיצות ביצועים בלי אימון מאפס. המשמעות המעשית: מחזור החיים של "המודל הכי משתלם" התקצר לשבועות בודדים, והיתרון עובר מהמעבדות אל מי שיודע להחליף מודלים מהר. הצוותים שיבנו את התשתית הגמישה הזו עכשיו הם אלה שירוויחו מהגל הבא, שכנראה כבר בדרך.

שאלות נפוצות

מה ההבדל בין DeepSeek V4 Flash ל-V4 Pro?

V4 Flash הוא המודל הקטן והזול של DeepSeek, ו-V4 Pro הוא מודל הדגל הגדול והיקר יותר. בסוף יולי 2026 גרסה מעודכנת של Flash עקפה את Pro במשימות סוכן וקוד, ועדכון V4-Pro-0813 מ-13 באוגוסט נועד לסגור את הפער הזה.

האם Gemini 3.7 Flash טוב יותר מ-Gemini 3.6 Flash?

כן, לפי מדדי Artificial Analysis הגרסה החדשה משתפרת ב-4 נקודות לעומת Gemini 3.6 Flash. בשכבת המודלים המהירים, שבה הפערים בין המתחרים קטנים, זהו שיפור משמעותי לשימושי סיווג, תמצות ועיבוד בנפח גבוה.

האם כדאי לעסק ישראלי להשתמש במודלים סיניים כמו GLM-5.3 או DeepSeek?

מבחינת עלות-ביצועים הם תחרותיים מאוד, במיוחד למשימות סוכן וקוד. עם זאת, ארגונים בתחומים רגולטוריים כמו פיננסים ובריאות צריכים לבחון שאלות של ריבונות נתונים, ולשקול הרצה מקומית של גרסאות פתוחות במקום שימוש ב-API חיצוני.

#DeepSeek V4 Pro#GLM-5.3#Gemini 3.7 Flash#Z.AI#מודלים פתוחים#מלחמת מחירים
מה דעתכם?

דרגו את הכתבה

הדירוג עוזר לנו לדעת מה שווה לכם.

תגובות

התגובה חייבת להיות בעברית ומתפרסמת מיד.
  1. היו הראשונים להגיב.

עוד בנושא