דילוג לתוכן הראשי

NVIDIA מציעה לאכוף הרשאות לסוכני AI מחוץ לסוכן עצמו

הפלטפורמה של NVIDIA משלבת את OpenShell ו־Sentry לאכיפת הרשאות מחוץ לסוכני AI. החברה טוענת לבידוד חריגות באלפיות שנייה, אך לא הוצגה בדיקה עצמאית.

יעל ברנעיעל ברנעעורכת ראשית
·5 דק׳ קריאה
0:00 / 4:31
טכנאי בוחן כרטיס האצת תשתיות לצד שרת פתוח בחדר שרתים, להמחשת אכיפה ברמת התשתית

מי עוצר סוכן AI כשהוא מנסה לעשות משהו שאסור לו? NVIDIA הכריזה ב־28 בספטמבר 2026 על NVIDIA Open Agent Safety Platform, פלטפורמה שנועדה לאכוף הרשאות מחוץ לסוכן עצמו, ולא להסתפק בהוראות למודל. עבור ארגונים בישראל שמחברים סוכנים למידע ולמערכות תפעוליות, זו הצעה להעביר חלק מההגנה משיקול הדעת של המודל אל התשתית שמאפשרת לו לפעול.

מה הוכרז: OpenShell בתוכנה, Sentry על גבי DPU

הפלטפורמה כוללת את תוכנת הקוד הפתוח OpenShell ואת תכנון מערכת הפיקוח Sentry, הפועלת על מעבדי BlueField-4 DPU. לפי NVIDIA, המערכת יכולה לבודד בתוך אלפיות שנייה סוכן שמנסה לחרוג מגבולותיו. זו טענה של החברה על יכולות המערכת, ולא תוצאה של בדיקת חסינות עצמאית שהוצגה בתחקיר.

ההבחנה החשובה בהכרזה היא מיקומה של האכיפה: מחוץ לסוכן. במקום להניח שהמודל תמיד יפרש נכון את מדיניות הארגון, הרעיון הוא להציב גבול גם במקום שבו הפעולה מתבצעת. כך, לפחות ברמת התכנון, ניסיון לבצע פעולה אסורה אינו חייב להפוך לפעולה שבוצעה לפני שמישהו מבחין בחריגה.

עם זאת, אין בתחקיר פירוט מספיק כדי לקבוע אילו יכולות זמינות בכל תצורת פריסה, מהן דרישות החומרה של כל רכיב או מה תהיה עלות ההטמעה. העובדה ש־OpenShell היא תוכנת קוד פתוח אינה מוכיחה שכל מעטפת הפיקוח ניתנת להפעלה בכל סביבה. מנגד, הקישור בין Sentry ל־BlueField-4 DPU אינו בסיס לקביעה שכל שימוש ב־OpenShell מחייב את אותה חומרה.

למה הוראה למודל אינה תחליף לגבול טכני

סוכן AI אינו רק ממשק שמחזיר תשובה. כאשר מחברים אותו לכלים, הוא עשוי לקרוא מסמכים, לשלוח מידע או לבקש שינויים במערכות. כל חיבור כזה יוצר שאלה נפרדת: לא רק האם הסוכן הבין מה ביקשו ממנו, אלא האם מותר לו לבצע את הפעולה שבחר. תשובה נכונה לכאורה יכולה עדיין להוביל לשימוש רחב מדי בהרשאות.

לדוגמה, אפשר להנחות סוכן שירות להשתמש רק בתיק הלקוח שעליו נשאל. אבל אם חשבון השירות שלו מאפשר גישה למאגר שלם, ההוראה לבדה אינה מצמצמת את ההרשאה הטכנית. שכבת אכיפה חיצונית נועדה לטפל בפער הזה. זו המחשה לעיקרון שמאחורי ההכרזה, לא תיאור של יכולת מסוימת שאומתה עבור המוצר.

הוראה אומרת לסוכן מה אסור לעשות; אכיפה צריכה למנוע ממנו לעשות זאת גם כשהוא מנסה.
עיקרון אבטחה, בניסוח המערכת

הפרדה כזאת אינה מבטלת את הצורך במודל אמין או בבדיקות התנהגות. היא מוסיפה נקודת בקרה שאמורה להישאר אפקטיבית גם כאשר הסוכן טועה. לכן השאלה המעניינת אינה רק כמה מהר מזהים חריגה, אלא אילו פעולות עוברות דרך הבקרה, האם קיימים נתיבים שעוקפים אותה ומה קורה כשמנגנון הפיקוח עצמו אינו זמין.

צוות אבטחת מידע בחדר ישיבות בוחן תרשים מודפס של חיבור סוכן שירות למאגר לקוחות ולמערכת דואר
מיפוי הגישה לכלים ולמידע הוא תנאי להגדרת גבולות שימושיים לסוכן. סצנת המחשה.

המשמעות בישראל: לבדוק את הסוכן מול המערכות האמיתיות

לחברת תוכנה ישראלית שמפתחת סוכן תמיכה, או לעסק שמפעיל סוכן לניהול מסמכים, הערך האפשרי אינו מסתכם בעוד שכבת סייבר. אם אפשר להגדיר גבולות שנאכפים בפועל, קל יותר להבחין בין משימות שאפשר לאפשר באופן אוטומטי לבין פעולות שדורשות אישור אנושי. ההחלטה עדיין תלויה ברגישות המידע ובנזק האפשרי מטעות, ולא רק ביכולת המוצר לעצור סוכן.

בתרחיש מקומי אפשר לחשוב על סוכן שקורא פניות בעברית ובאנגלית, מחפש פרטי הזמנה ומכין תשובה ללקוח. הרשאה לקרוא הזמנה אינה הרשאה לייצא את כל רשימת הלקוחות; הרשאה לנסח הודעה אינה בהכרח הרשאה לשלוח אותה. אלה גבולות עסקיים שצריך לתרגם להרשאות טכניות, בלי קשר לשפה שבה הסוכן עובד.

  • למפתחי המוצר: למפות בנפרד קריאה, כתיבה, מחיקה ושליחה לכל מערכת שהסוכן מחובר אליה.
  • לצוותי אבטחה: לבדוק אם גם חיבורים עקיפים ושירותי ביניים נכללים בגבולות האכיפה.
  • למנהלי התשתיות: לברר אילו רכיבים מתאימים לסביבת הענן או לשרתים הקיימים, ואילו דורשים שינוי.
  • לבעלי התהליך העסקי: להגדיר מי מאשר פעולה רגישה, מי מקבל התראה ומי מוסמך להחזיר סוכן לפעילות.

עבור צוות קטן בארץ, בדיקת ההתאמה לתשתית הקיימת עשויה להיות חשובה לא פחות מהבטחת המהירות. פתרון שמצריך שינוי באופן הפריסה, בהרשאות השירותים או בתפעול התקלות צריך להיבחן כחלק ממערכת שלמה. אין בתחקיר נתוני עלות או ביצועים שמאפשרים להעריך את הכדאיות הזאת מראש.

מה עדיין צריך להוכיח לפני פריסה בייצור

בידוד בתוך אלפיות שנייה הוא טענת NVIDIA, לא ערובה שלא נגרם נזק. בבדיקה מעשית צריך לברר מתי מתחילה המדידה והאם הפעולה האסורה נחסמה לפני שבוצעה.

מבחן מועיל יכלול גם סוכן שמבקש פעולה שאסורה לו, וגם פעולה מותרת שעלולה להיחסם בטעות. צריך לבדוק אם מידע כבר יצא מהמערכת לפני הבידוד, אם נשאר תיעוד שמסביר את ההחלטה, ואם אפשר לחדש את התהליך בלי להעניק לסוכן הרשאות רחבות יותר. אלה שאלות לבחינת הפלטפורמה, לא ממצאים שכבר הוכחו לגביה.

חשוב גם להפריד בין חסימת פעולה חריגה לבין זיהוי פעולה מזיקה שנמצאת בתוך ההרשאות. סוכן שמורשה לשלוח הודעות עלול לשלוח הודעה שגויה בלי לחרוג מגבול הגישה שהוגדר לו. אכיפה תשתיתית אינה מחליפה בדיקת תוכן, הגדרת תהליך נכון או אישור אנושי במקום שבו לטעות יש מחיר גבוה.

ההכרזה של NVIDIA מציבה כיוון ברור: בטיחות של סוכני AI צריכה להיבחן גם בשכבה שמאפשרת להם לפעול, ולא רק בתשובות שהם מייצרים. הצעד הבא לארגון ישראלי ששוקל את הפלטפורמה הוא ניסוי מוגבל מול תהליך עבודה אמיתי, עם הרשאות מצומצמות ומבחני חריגה מוגדרים. רק כך אפשר לברר אם ההבטחה לאכיפה חיצונית מתורגמת להגנה שימושית בסביבה שלו.

שאלות נפוצות

מהי NVIDIA Open Agent Safety Platform?

זו פלטפורמה שעליה הכריזה NVIDIA ב־28 בספטמבר 2026, לאכיפת הרשאות של סוכני AI מחוץ לסוכן עצמו. היא כוללת את תוכנת הקוד הפתוח OpenShell ואת תכנון מערכת הפיקוח Sentry, הפועלת על מעבדי BlueField-4 DPU.

מה ההבדל בין הוראות לסוכן AI לבין אכיפת הרשאות חיצונית?

הוראות מבקשות מהמודל להימנע מפעולה, בעוד אכיפה חיצונית נועדה למנוע את ביצועה גם כשהסוכן מנסה לחרוג מהן. ההגנה בפועל תלויה בכיסוי של שכבת האכיפה ובהרשאות שהארגון הגדיר.

האם חייבים חומרת NVIDIA כדי להשתמש ב־OpenShell?

בתחקיר מצוין כי Sentry פועלת על BlueField-4 DPU, אך לא מפורטות דרישות החומרה של כל רכיב בפלטפורמה. לכן אין להסיק מכך שכל שימוש ב־OpenShell מחייב אותה חומרה; יש לבדוק את דרישות הפריסה של הרכיב והיכולת המבוקשים.

#NVIDIA#OpenShell#Sentry#BlueField-4 DPU#אבטחת סוכני AI
מה דעתכם?

דרגו את הכתבה

הדירוג עוזר לנו לדעת מה שווה לכם.

תגובות

התגובה חייבת להיות בעברית ומתפרסמת מיד.
  1. היו הראשונים להגיב.

עוד בנושא