דילוג לתוכן הראשי

GPT-6 Astra יצא לכל המנויים: 99.9% ב-ARC-AGI-3 והשקה מבולגנת

OpenAI השיקה את GPT-6 Astra עם תוצאות שיא ב-ARC-AGI-3 ו-FrontierMath, השקה מדורגת שהסתבכה והתנצלות של אלטמן. מה זה אומר למשתמשים בישראל.

יעל ברנעיעל ברנעעורכת ראשית
·4 דק׳ קריאה·2 צפיות
0:00 / 6:38
אירוע השקה טכנולוגי הומה קהל, מציג על במה מוארת מול מסך ענק

OpenAI השיקה ב-3 בספטמבר את GPT-6 Astra, שאותו היא מגדירה כמודל האינטליגנטי והמיושר ביותר שבנתה עד כה, עם יכולות state-of-the-art בשימוש במחשב, בכתיבת קוד, בסייבר ובמדע. יום אחרי החשיפה, ביום שישי, המודל נפתח לכלל המשתמשים המשלמים, אחרי rollout מדורג שהסתבך מספיק כדי שסם אלטמן יתנצל עליו בפומבי ב-X. עכשיו, כשהאבק שוקע, אפשר לבחון מה באמת יש כאן ומה זה אומר למשתמשים בארץ.

מה קרה: מספרים שלא ראינו קודם

הנתונים שפרסמה OpenAI חריגים גם במונחים של שוק שהתרגל לקפיצות. Astra 'מרווה' את FrontierMath Tier 4, הרף הקשה ביותר במתמטיקה מחקרית, עם 98%, מגיע ל-99.9% ב-ARC-AGI-3 ול-100% ב-ExploitBench. כדי להבין את גודל הפער: GPT-5.6 Sol, המודל הקודם של OpenAI, השיג רק 7.8% ב-ARC-AGI-3, ו-Claude Opus 5 של אנת'רופיק עצר על 30%. זו לא שיפור הדרגתי אלא קפיצת מדרגה שמרוקנת חלק מהבנצ'מרקים המרכזיים מתוכן, ומחזירה לשולחן את השאלה איך בכלל מודדים מודלים מהדור הזה.

  • FrontierMath Tier 4: 98% — רוויה כמעט מלאה של בנצ'מרק המתמטיקה הקשה ביותר
  • ARC-AGI-3: 99.9%, לעומת 7.8% בלבד ל-GPT-5.6 Sol ו-30% ל-Claude Opus 5
  • ExploitBench: 100% — תוצאה מושלמת בבנצ'מרק ניצול חולשות
  • זמינות: כל מנויי Plus, Pro, Business ו-Enterprise, וגם דרך API, Azure ו-AWS Bedrock

ההשקה שהסתבכה: התנצלות פומבית מאלטמן

כמו בהשקות קודמות של OpenAI, גם הפעם ה-rollout לא עבר חלק. החברה בחרה בפריסה מדורגת, אבל המעבר המהיר משחרור מוגבל לפתיחה לכלל המשתמשים המשלמים תוך יום אחד יצר בלבול: משתמשים לא ידעו אם הם כבר מקבלים את Astra או את המודל הקודם, ואלטמן נאלץ להתנצל ב-X על מה שהוא עצמו תיאר כהשקה מבולגנת. עבור חברה שמנהלת את מוצר הצריכה הגדול בעולם ה-AI, זו תזכורת שגם ההנדסה של רגע ההשקה עצמו היא אתגר בקנה מידה שאין לו תקדים.

הפער בין 7.8% ל-99.9% באותו בנצ'מרק בתוך דור אחד הוא לא שיפור, זה שבר. הבעיה של כולנו עכשיו היא שנגמרו לנו הסרגלים למדוד איתם
חוקר הערכת מודלים בתעשייה
מהנדסת תוכנה בוחנת השוואת ביצועי מודלים על שני מסכים בחדר עבודה של סטארטאפ תל אביבי
צוותי פיתוח בארץ כבר מריצים השוואות בין Astra למודלים הקיימים בסביבות הייצור שלהם

הצד השני של המטבע: מודל ברמת סייבר קריטית

לצד חגיגת הבנצ'מרקים, OpenAI פרסמה כרטיס מערכת חריג: Astra הוא המודל הראשון של החברה שמסווג ברמת יכולת סייבר 'קריטית' תחת מסגרת ה-Preparedness. בתרגום מעשי, עם הכלים והגישה הנכונים המודל מסוגל למצוא פרצות אבטחה לא מוכרות ולפתח דרכי ניצול חדשות במערכות מוגנות היטב, בלי הנחיה אנושית בכל שלב. בהתאם, החברה מדווחת שחיזקה משמעותית את ההגנות סביב פעולות סייבר מזיקות, וחברות המשתתפות בתוכנית הסייבר שלה, Daybreak, קיבלו גישה ראשונות למודל.

OpenAI עצמה מדברת על 'חלון המגן': פרק הזמן שבו יכולות סייבר חזיתיות משרתות קודם כל את הצד המתגונן, שיכול לסרוק את המערכות שלו ולמצוא חולשות לפני התוקפים. אבל אותו חלון עובד לשני הכיוונים, והתוצאה המושלמת ב-ExploitBench ממחישה כמה דק הקו הזה.

ארגונים שמאפשרים לעובדים גישה חופשית ל-Astra דרך ה-API צריכים לעדכן מדיניות שימוש: מודל ברמת סייבר קריטית מחייב בקרות גישה, ניטור prompts רגישים והגדרות ברורות של מה מותר להריץ מול מערכות פנימיות.

למה זה משנה בישראל

ההשלכה המיידית פשוטה: מאות אלפי מנויים ישראלים של ChatGPT Plus, Pro, Business ו-Enterprise מקבלים את Astra כבר עכשיו, במסגרת המנוי הקיים ובלי תוספת תשלום. מפתחים יכולים לגשת אליו דרך ה-API וגם דרך Azure ו-AWS Bedrock, מה שרלוונטי במיוחד לארגונים ישראלים שכבר עובדים בעננים האלה בגלל דרישות רגולציה ואבטחה.

אבל הזווית הישראלית המעניינת באמת היא הסייבר. תעשיית הסייבר המקומית, שבנתה חלק ניכר מהערך שלה על מומחיות אנושית באיתור חולשות ובניתוח איומים, מקבלת עכשיו מודל זמין מסחרית שמסווג רשמית כמסוגל לבצע חלק מהעבודה הזו לבד. עבור חברות הגנה זו הזדמנות לשלב יכולת חדשה במוצרים, ועבור צוותי red team זה כלי עבודה חדש. ובמקביל, כל CISO בארץ צריך להניח שגם הצד השני יחפש דרכים לעקוף את ההגנות ש-OpenAI הציבה סביב המודל.

מה הלאה

השאלות הפתוחות ברורות: כמה מהר יגיבו אנת'רופיק וגוגל עם מודלים מקבילים, איך תיראה מסגרת המדידה החדשה אחרי שהבנצ'מרקים הוותיקים נרוו, והאם סיווג הסייבר הקריטי יגרור התערבות רגולטורית, בארה"ב או באירופה. בינתיים, ההמלצה הפרקטית למשתמשים ולצוותים בארץ היא לבחון את Astra על המשימות האמיתיות שלהם, ולא להסתפק בכותרות הבנצ'מרקים: הפער בין תוצאה במבחן לביצועים על הקוד והדאטה שלכם הוא עדיין המבחן שקובע.

שאלות נפוצות

מה זה GPT-6 Astra ומתי הוא הושק?

GPT-6 Astra הוא מודל הדגל החדש של OpenAI, שהושק ב-3 בספטמבר 2026. החברה מציגה אותו כמודל האינטליגנטי והמיושר ביותר שלה, עם יכולות state-of-the-art בשימוש במחשב, קוד, סייבר ומדע.

איך מקבלים גישה ל-GPT-6 Astra בישראל?

המודל זמין לכל המנויים המשלמים של ChatGPT בתוכניות Plus, Pro, Business ו-Enterprise במסגרת המנוי הקיים, ללא תוספת תשלום. מפתחים וארגונים יכולים לגשת אליו גם דרך ה-API של OpenAI, וכן דרך Azure ו-AWS Bedrock.

במה GPT-6 Astra טוב יותר מהמודלים הקודמים?

המודל מגיע ל-99.9% ב-ARC-AGI-3 לעומת 7.8% בלבד של GPT-5.6 Sol, ל-98% ב-FrontierMath Tier 4 ול-100% ב-ExploitBench. הוא גם המודל הראשון של OpenAI שמסווג ברמת יכולת סייבר קריטית תחת מסגרת ה-Preparedness.

#GPT-6 Astra#OpenAI#ChatGPT#בנצ'מרקים#ARC-AGI-3#סם אלטמן
מה דעתכם?

דרגו את הכתבה

הדירוג עוזר לנו לדעת מה שווה לכם.

תגובות

התגובה חייבת להיות בעברית ומתפרסמת מיד.
  1. היו הראשונים להגיב.

עוד בנושא