DeepSeek Harness: פריימוורק הסוכנים הפתוח ששובר שיאים ב-GitHub
DeepSeek Harness יצא ל-Developer Preview ברישיון MIT וצבר 135 אלף כוכבים בארבעה ימים. למה הוא משנה את קריאת הבנצ'מרקים ומה זה אומר למפתחים בישראל.

ב-13 באוגוסט שחררה DeepSeek את Harness, פריימוורק סוכנים בקוד פתוח ברישיון MIT, במקביל להכרזת ה-GA של DeepSeek-V4-Pro. ארבעה ימים אחר כך ה-API של GitHub כבר הראה 135,042 כוכבים ו-13,592 פורקים, מספרים שממקמים את הריפו בין ההשקות המהירות ביותר שנראו בתחום. מעבר להייפ, מדובר במהלך אסטרטגי ברור: DeepSeek נכנסת לשכבת ה"פיגומים" שמעל המודל, בדיוק הטריטוריה שאנת'רופיק בנתה עם Claude Code.
מה בדיוק שוחרר: הכול פלאגין, כולל הלולאה עצמה
Harness יצא ל-Developer Preview כפריימוורק אגנוסטי לספקים. הרעיון המרכזי שלו רדיקלי בפשטותו: כל שכבה במערכת היא פלאגין שניתן להחלפה. שכבת ההסקה (inference), חיבור הכלים, ניהול מצב הסשן, ואפילו לולאת הסוכן עצמה, כולם רכיבים מודולריים שאפשר להוציא, להחליף או לכתוב מחדש. בניגוד לפריימוורקים שקושרים אתכם למודל של יצרן מסוים, כאן אפשר להריץ את אותה ארכיטקטורת סוכן מול ספקים שונים.
מתחת למכסה המנוע, הפריימוורק בנוי על Cordis, שהעיצוב שלו מתואר במאמר מחקר בשם "A Programming Paradigm for Spatiotemporal Composability" שפורסם אף הוא ב-13 באוגוסט. כלומר, לא מדובר רק בכלי הנדסי אלא בתוצר של עבודה מחקרית על האופן שבו מרכיבים מערכות סוכניות מחלקים ניתנים להחלפה.
- רישיון MIT: שימוש מסחרי חופשי, בלי מגבלות של רישיונות "פתוחים למחצה"
- אגנוסטי לספקים: אותו סוכן יכול לרוץ מול מודלים שונים בלי שכתוב
- ארכיטקטורת פלאגינים מלאה: הסקה, כלים, מצב סשן ולולאת הסוכן, כולם ניתנים להחלפה
- מצב מינימלי (minimal mode) שמשמש גם להערכת בנצ'מרקים של V4-Pro
ההערה הקטנה שמשנה את קריאת הבנצ'מרקים
החלק המעניין באמת מבחינה מחקרית מסתתר בטבלת הבנצ'מרקים של V4-Pro. בהערת מתודולוגיה, שחוזרת גם בכרטיס המודל ב-Hugging Face, מצוין שמשימות סוכן הקוד הציבוריות הוערכו כשהמודל רץ בתוך המצב המינימלי של Harness. VentureBeat חידדה את המשמעות: חלק מהתוצאות אינן בנצ'מרק טהור של מודל, אלא מדידה של מודל בתוך סביבת הרצה סוכנית.
כשמעבדה מדווחת תוצאה על משימת סוכנים, השאלה הראשונה שצריך לשאול היא איזה harness רץ מסביב למודל. אותו מודל בדיוק יכול להיראות בינוני או מצטיין רק בגלל הפיגומים.
המשמעות המעשית: השוואה בין מודלים סוכניים של יצרנים שונים כבר אינה השוואת תפוחים לתפוחים, אלא השוואת מודל-פלוס-סביבה למודל-פלוס-סביבה אחרת. DeepSeek לפחות שיחררה את הסביבה שלה בקוד פתוח, כך שכל אחד יכול לשחזר את התנאים. זה תקדים שסביר שיופעל כלחץ גם על מעבדות אחרות.

אלטרנטיבה פתוחה אמיתית ל-Claude Code
עד עכשיו, מי שרצה סוכן קידוד ברמה מסחרית עם שכבת הרצה בשלה נשען בעיקר על כלים קנייניים כמו Claude Code של אנת'רופיק. Harness מציע לראשונה חלופה פתוחה מבית מעבדת פרונטיר, לא פרויקט קהילתי שנאבק על תחזוקה, אלא תשתית שמעבדה גדולה משתמשת בה בעצמה להערכת המודלים שלה. העובדה שהוא שוחרר באותו יום עם ה-GA של V4-Pro מרמזת ש-DeepSeek רואה בצמד מודל-פריימוורק מוצר אחד.
מדובר ב-Developer Preview: ה-API עשוי להשתנות בין גרסאות, ומי שבונה עליו מערכת ייצור צריך לנעול גרסה ולעקוב אחרי ה-changelog. קצב הפיתוח בריפו כרגע מהיר מאוד.
מה זה אומר למפתחים ולחברות בישראל
לחברות ישראליות שבונות מוצרים סוכניים, ויש לא מעט כאלה, Harness פותר שתי כאבי ראש בבת אחת. הראשון הוא vendor lock-in: ארכיטקטורת הפלאגינים מאפשרת להחליף ספק מודלים בלי לשכתב את לוגיקת הסוכן, מה שרלוונטי במיוחד לצוותים שמנהלים תקציבי inference משתנים או נדרשים לעמוד בדרישות רגולטוריות לגבי מיקום עיבוד הנתונים. השני הוא שקיפות בהערכה: צוותי מחקר ו-MLOps יכולים להריץ בנצ'מרקים פנימיים באותו מצב מינימלי שבו DeepSeek מודדת, ולקבל השוואה הוגנת בין מודלים לפני החלטת רכש.
יש גם שיקול נגדי שכדאי להביא בחשבון: מדובר בפרויקט צעיר מאוד מבית מעבדה סינית, וארגונים בסקטורים רגישים בארץ יצטרכו לעבור על הקוד ועל תלויות הרשת שלו לפני אימוץ. היתרון של קוד פתוח ברישיון MIT הוא שהבדיקה הזאת אפשרית בכלל, אפשר להריץ אותו מקומית לחלוטין, מנותק מכל שירות חיצוני.
מה הלאה: מלחמת הפיגומים רק מתחילה
ההיענות של הקהילה, עשרות אלפי פורקים תוך ימים, מרמזת שהשכבה הסוכנית הופכת לזירת התחרות הבאה, אולי יותר מהמודלים עצמם. אם המגמה תימשך, נראה יצרנים נוספים משחררים את סביבות ההרצה שלהם, ותקני הערכה שמפרידים במפורש בין ביצועי מודל לביצועי פיגומים. בינתיים, למי שרוצה להתנסות, הריפו זמין ב-GitHub, והמצב המינימלי הוא נקודת התחלה טובה להבין איך V4-Pro באמת נמדד.
שאלות נפוצות
מה זה DeepSeek Harness?
DeepSeek Harness הוא פריימוורק סוכנים בקוד פתוח ברישיון MIT ששוחרר ל-Developer Preview ב-13 באוגוסט 2026. הוא אגנוסטי לספקים ובנוי כך שכל שכבה, הסקה, כלים, מצב סשן ולולאת הסוכן, היא פלאגין שניתן להחלפה.
האם DeepSeek Harness הוא תחליף ל-Claude Code?
הוא מציע פונקציונליות דומה של שכבת הרצה לסוכני קוד, אבל בקוד פתוח מלא ובלי תלות בספק מודלים מסוים. הוא עדיין ב-Developer Preview, כך שלסביבות ייצור נדרשת זהירות, אבל לצוותים שרוצים שליטה מלאה זו אלטרנטיבה אמיתית.
איך Harness משפיע על בנצ'מרקים של מודלים?
לפי הערת המתודולוגיה של DeepSeek, משימות סוכן הקוד של V4-Pro הוערכו כשהמודל רץ בתוך המצב המינימלי של Harness. כלומר חלק מהתוצאות מודדות מודל בתוך סביבת הרצה סוכנית, ולא את המודל לבדו, וזה משנה את האופן שבו נכון להשוות בין מודלים.
דרגו את הכתבה
הדירוג עוזר לנו לדעת מה שווה לכם.



תגובות