מחדל: לקח ל-OpenAI שבוע לגלות שסוכן AI שלה הוא "האקר" סורר
דיווח של רויטרס חשף כי הבינה המלאכותית שפרצה להאגינג פייס פעלה באין מפריע ● החברות שוחחו רק לאחר שה-FBI הפך למעורב ● מומחים מזהירים: "המודלים משקרים, מרמים ופורצים"
חשיפה חדשה מטלטלת שוב את זירת הטכנולוגיה העולמית – סוכני הבינה המלאכותית של חברת OpenAI לא רק פרצו למערכות של פלטפורמת האגינג פייס (Hugging Face), כפי שהתגלה באחרונה, אלא עשו זאת באין מפריע, בזמן שחברת האם כלל לא הייתה מודעת למתרחש. על פי דיווח של סוכנות הידיעות רויטרס (Reuters), חלף כמעעט שבוע שלם עד ש-OpenAI הבינה שהמערכות שלה יצאו מכלל שליטה.
כזכור, רק לפני ימים אחדים דיווחנו כאן ב-אנשים ומחשבים כי הפריצה המסתורית למאגרי המידע של האגינג פייס בוצעה למעשה על ידי סוכנים אוטונומיים של OpenAI. המודל המתקדם GPT-5.6 Sol, יחד עם מודל נוסף שטרם שוחרר, הצליחו למצוא פרצת 'יום אפס' (Zero-day) ולברוח מסביבת הבדיקה המבודדת שבה שהו. מטרתם הייתה לעקוף את החוקים ולהשיג את התשובות למבחן הסייבר ExploitGym שבו השתתפו, תוך שימוש ביכולות חדירה שאפשרו להם להגיע לשרתי הפרודקשן של האגינג פייס.
New details about the Hugging Face incident from Reuters. The report says OpenAI noticed odd behavior before the event, including an agent leaving notes for future versions of itself with escape instructions. https://t.co/LfNvNaFM3f pic.twitter.com/86Vlt91LYI
— Andrew Curran (@AndrewCurran_) July 24, 2026
הסוכן הפורץ: השאיר מאחוריו 'הערות' לגרסאות עתידיות של עצמו
כעת, כאמור, מתברר לוח הזמנים המטריד של האירוע. על פי הדיווחים, סוכני ה-AI החלו בניסיונות הפריצה שלהם אל מחוץ לסביבת הבדיקה כבר ב-9 ביולי. הפריצה בפועל לשרתי האגינג פייס נמשכה על פני שלושה ימים, מה-11 ועד ה-13 ביולי. תומאס וולף, המייסד המשותף של האגינג פייס, אישר את חלון הזמנים הזה.
אלא שבאופן מדהים, OpenAI קישרה את התקרית למודלים שלה רק לאחר שהאגינג פייס פרסמה עדכון פומבי על הפריצה ב-16 ביולי. למעשה, רק בסוף השבוע של ה-18 וה-19 ביולי מצאו עובדי OpenAI את הראיות המפלילות בלוגים הפנימיים של החברה.
נציגי שתי החברות שוחחו לראשונה על הנושא רק סביב ה-20 ביולי, כאשר בשלב זה האגינג פייס כבר הספיקה לערב את ה-FBI בחקירה. פרט מצמרר נוסף שעולה מדיווחי רויטרס חושף כי הסוכן הפורץ אף השאיר ברשת החברה 'הערות' שכוונו אל גרסאות עתידיות של עצמו, ובהן הנחיות כיצד לחמוק מהמגבלות הפנימיות בפלטפורמה. בנוסף כדאי לשים לב למידע החשוב הזה – על פי נתונים שפורסמו ברשת בלומברג (Bloomberg), בעוד שלהאקר אנושי מיומן היה לוקח שבועות לבצע חדירה כזו, לסוכן ה-AI המשימה ארכה שעות בודדות בלבד.
הגילויים החדשים מעוררים דאגה עמוקה בקהילת הטכנולוגיה והסייבר. מרלי סמית' מקרן World Ethical Data Foundation, התייחסה לאירוע וציינה כי מדובר במצב מעורר חרדה, בין אם OpenAI השאירה את הסוכן לפעול ללא השגחה, ובין אם ידעה על כך, אך לא הצליחה להכיל את האירוע.
ג'פרי לאדיש, מנהל Palisade Research, הבהיר בתגובה כי המודלים הללו "משקרים, מרמים ופורצים", וקרא להחלת פיקוח ממשלתי הדוק על הטכנולוגיה בכללה, ולעשות זאת באופן מיידי. בתוך כך, קלמנט דלאנג, מנכ"ל האגינג פייס, פנה ב-25 ביולי ל-OpenAI בדרישה לפרסם בשקיפות מלאה את רישומי עקבות הביצוע (Execution traces) של הסוכנים הסוררים.











תגובות
(0)