UNPWNED AGENT PROOF // B2B BOUNDARY ASSESSMENT
לא שואלים Agent אם הוא מכבד גבולות. בודקים אותם.
תכנית בדיקה שנמצאת בהכנה לחברות שבונות AI Agents וצריכות להראות ללקוחות ארגוניים מה נבדק, מול איזה build, אילו תרחישים נבלמו ומה עדיין לא נבדק.
מעבדת ייחוס מקומית
5 שיטות, 24 הגדרות ו־48 הרצות סינתטיות
Staging מורשה של Design Partner
Scope, SOW, DPA והרשאת עצירה לפני חיבור
Production ומידע משתמשים אמיתי
לא נבדקו ולא מחוברים כיום
הבעיה העסקית
Agent יכול להיראות נכון ועדיין לפעול מחוץ לסמכות שלו.
בדיקות איכות תשובה אינן מוכיחות הפרדת tenants, הרשאות לכלים או אישור אנושי בלתי תלוי. כאשר Agent יכול להגיע למידע ולפעולות, כשל קטן במדיניות יכול להפוך לחשיפת מידע או לשינוי שבוצע בשם האדם הלא נכון.
אנחנו בודקים את נקודת האכיפה עצמה: מי ביקש, על איזה משאב, באיזה תפקיד, מה הוחלט, איזו השפעה נצפתה והאם המערכת חזרה למצב הבסיס.
חמש שיטות הגבול
בודקים סמכות, לא רק תוכן.
כל שיטה מופעלת רק אם היא רלוונטית ל־Agent ונכללת במפורש ב־scope המאושר.
AP-TENANT-READ-001הפרדת קריאה בין ארגונים
האם משתמש או Agent יכולים לקרוא מידע ששייך ל־tenant אחר?
חשיפת מידע, אובדן סודיות ופגיעה באמון לקוחות ארגוניים.
AP-TENANT-WRITE-002הפרדת כתיבה בין ארגונים
האם פעולה יכולה לשנות רשומה או מצב ששייכים ל־tenant אחר?
פגיעה בשלמות מידע, נזק עסקי ושינוי ללא סמכות.
AP-TOOL-SCOPE-003גבולות כלים והרשאות
האם ה־Agent יכול להפעיל כלי שלא הוקצה לתפקיד המבקש?
הרחבת blast radius בין APIs, מאגרי מידע ופעולות ניהול.
AP-APPROVAL-004אישור אנושי לפעולות רגישות
האם פעולה רגישה דורשת approver תקף, נפרד ומתאים?
פעולה פיננסית או ניהולית ללא אישור מתועד.
AP-UNTRUSTED-CONTENT-005תוכן לא מהימן מול סמכות
האם תוכן עוין יכול להפוך לכוונת כלי מאושרת או לפעולה?
Prompt injection עובר מטקסט לא מהימן להשפעה בעולם האמיתי.
מסלול ההתקשרות
Assessment. Remediation. Retest. Proof.
החברה שולטת בסביבה ובסמכות העצירה. UNPWNED פועלת רק בתוך scope צר ומאושר.
- 01ללא גישה
מיפוי והגדרת scope
מזהים tenants, תפקידים, כלים, פעולות רגישות, build ואיש קשר לחירום.
- 02STAGING בלבד
הכנת staging סינתטי
מקימים חשבונות בדיקה, canaries סינתטיים ו־credentials קצרי חיים.
- 03ממצאים
הערכה ראשונית
מריצים תרחיש מאושר אחד בכל פעם, צופים בהשפעה ומשחזרים baseline.
- 04תיקון חברה
תיקון בבעלות החברה
החברה מתקנת ומעלה build חדש. UNPWNED מספקת ראיות ותכנית retest.
- 05ראיות פרטיות
Retest ו־Proof Pack
מריצים שוב את אותם תרחישים ומפרידים בין fixed, vulnerable ו־not tested.
תוצאת מעבדת הייחוס
מנוע עובד, עם טענה מוגבלת וברורה.
אותם תרחישים הופעלו מול שני builds נפרדים שהוכנו מראש במעבדה מקומית בבעלות UNPWNED.
תרחישי התקיפה המוגדרים נצפו בפרופיל הפגיע.
אותם תרחישים נבלמו בפרופיל המתוקן הנפרד.
התוצאה מאמתת רק את מעבדת הייחוס המקומית והסינתטית. היא אינה הערכת לקוח, בדיקת Production, הסמכה, חוות דעת ביקורת או הבטחת אבטחה.
עקרון מידע מינימלי
ראיות מספיקות. לא מחסן של תוכן לקוח.
הפיילוט המתוכנן מבוסס על חשבונות בדיקה ומידע סינתטי. ה־Proof Pack מתמקד בתצפיות מובנות וב־digests.
נדרש להוכחה
- Build ו־deployment identifier
- שיטת בדיקה וסטטוס
- Timestamp ו־run digest
- תוצאת effect מצומצמת
- Cleanup ו־retest binding
לא נכנס ל־Proof Pack
- Credentials או session tokens
- Secrets ומפתחות API
- Raw customer prompts
- תגובות מלאות או tool output
- מידע אמיתי של משתמשי קצה
לפני פיילוט אמיתי, ה־DPA וה־scope מגדירים במפורש שדות, מטרות, שמירה, מחיקה ונמענים. אין טענה שהשירות לעולם אינו מעבד מידע.
שלב ההתקשרות הראשון
Design Partner Discovery
אנחנו בודקים התאמה לפיילוט צר סביב ה־Agent ומודל ההרשאות של החברה, בלי להתחיל מגישה למערכת.
מבנה הפיילוט המוצע
- שיחת discovery ומפת גבולות
- Scope כתוב ו־staging מאושר
- שיטות הגבול הרלוונטיות ל־workflow
- דוח ממצאים ופגישת remediation
- Retest אחד מול build חדש
- Private Proof Pack מוגבל להיקף שנבדק
לא כלול
- גישה ל־Production
- מידע משתמשים אמיתי
- תיקון אוטומטי של קוד
- הסמכה או הבטחת אבטחה
העמוד מזמין שיחת discovery לא מחייבת בלבד. שום הערכה אינה מוצעת או מורשית עד שתנאים נפרדים, SOW, DPA ו־scope כתוב נכנסים לתוקף.
שאלות קצרות
מה השירות הזה כן ומה לא.
האם UNPWNED מתקנת את הבעיה אוטומטית?
לא. החברה מתקנת ומעלה build חדש. UNPWNED מריצה מחדש את אותם תרחישים ובודקת containment ו־positive controls.
האם זו בדיקת חדירות או הסמכה?
לא. זו הערכת שיטות גבול בהיקף מוגדר ושירות ראיות פרטי. היא אינה מחליפה pentest אנושי, audit או certification.
האם כבר נבדקה חברת AI אמיתית?
לא. התוצאה המאומתת כיום מכסה רק מעבדת ייחוס מקומית וסינתטית בבעלות UNPWNED. חיבור לחברת Design Partner הוא השלב הבא.
האם Agent Proof יכול להשלים כלי red team אחרים?
כן. המיקוד הוא בראיות הרשאה הקשורות ל־build וב־retest, לצד כלי הערכת תוכן, model safety ו־runtime guardrails.
השאלה הראשונה
איזו הוכחת אבטחה הלקוחות שלכם מבקשים לפני שהם מאשרים Agent?
השיחה הראשונה היא discovery בלבד. בלי credentials, בלי Production ובלי בקשות למערכת שלכם.

