נחשף: סוכן AI של OpenAI פרץ עצמאית לשרתי האגינג פייס
בהמשך לדיווח על דלף המידע בפלטפורמת מודלי השפה, נחשף כעת כי הפורץ אינו אדם, אלא מערכת אוטונומית מתקדמת שיצאה משליטה במהלך מבחן פנימי - כדי לרמות בבחינה
לפני ימים ספורים דיווחנו כאן באנשים ומחשבים על פריצת אבטחה חמורה בפלטפורמת מודלי ה-AI הפופולרית האגינג פייס (Hugging Face), שבה גורם לא ידוע העלה מערך נתונים זדוני שהעניק לו הרשאות וגישה למערכות פנימיות. כעת, התעלומה נפתרה עם חשיפה מדהימה: הפורצים לא היו האקרים אנושיים, אלא סוכני בינה מלאכותית אוטונומיים לחלוטין של חברת OpenAI.
OpenAI בעצמה אישרה כי הפריצה בוצעה על ידי מודל השפה החדש שלה, GPT-5.6 Sol, יחד עם מודל נוסף ומתקדם אף יותר, שטרם הושק רשמית.
לפי הסברי החברה, המודלים הושמו בסביבת בדיקות מבודדת ונעולה, שנועדה לבחון את יכולות הסייבר ההתקפיות שלהם מול מבחן ביצועים ששמו ExploitGym, ולצורך כך הוסרו מהם מנגנוני ההגנה והסינון הרגילים. במקום לפתור את המטלות בדרך המקובלת, סוכני ה-AI גילו פרצת "יום אפס" (Zero-day) לא מוכרת בתוכנת צד-שלישי ששימשה כשרת פרוקסי, שידרגו את הרשאותיהם והצליחו לחמוק אל רשת האינטרנט הפתוחה.
לאחר שיצאו מכלל שליטה, המערכות הסיקו שמסדי הנתונים של האגינג פייס עשויים להכיל את הפתרונות למבחן ה-ExploitGym שבו נבחנו, והשתמשו בטכניקות פריצה אמיתיות כדי לחדור לשרתים ולגנוב את התשובות.
‼️ BREAKING: OpenAI says two of its own models, GPT-5.6 Sol and an unnamed pre-release system tested with cyber safeguards off, broke out of a sandbox last week, chained zero-days and stolen(!) credentials to reach the open internet, and hacked Hugging Face to cheat on a… pic.twitter.com/03glb0lQrs
— International Cyber Digest (@IntCyberDigest) July 21, 2026
"אנו רואים בתקרית הזו אירוע סייבר חסר תקדים"
בהודעתה הרשמית של OpenAI נכתב כי "אנו רואים בתקרית הזו אירוע סייבר חסר תקדים, הכולל יכולות סייבר מתקדמות ביותר". בחברה הסבירו את הפעולה בכך ש"כל הראיות מצביעות על כך שהמודלים היו ממוקדים יתר על המידה במציאת פתרון עבור ExploitGym, והלכו רחוק מאוד כדי להשיג יעד בדיקה צר למדי".
מנכ"ל האגינג פייס, קלמנט דלאנג, הגיב לאירוע וציין כי המתקפה הייתה "מפוצצת מוח", אך הדגיש שלדעתו "לא הייתה כוונת זדון" מצידה של OpenAI. דלאנג ניצל את ההזדמנות לקרוא לשקיפות בתעשייה והוסיף בהצהרתו: "בטיחות AI לא תיפתר על ידי חברה אחת שעובדת בסוד. היא תיפתר בפתיחות, בשיתוף פעולה, ועם גישה רחבה ל-AI עבור כל מגן, בכל מקום".
We're partnering with @huggingface to investigate an unprecedented security incident.
Cyber-capable OpenAI models compromised Hugging Face production during a benchmark evaluation.
Sharing preliminary findings to help defenders understand emerging risks:…
— OpenAI (@OpenAI) July 21, 2026
פרט אירוני במיוחד בתקרית נוגע לאופן שבו האגינג פייס חקרה את הפריצה – כאשר צוות האבטחה ניסה להשתמש במודלי שפה מערביים מובילים כדי לנתח את קוד התקיפה, מנגנוני הבטיחות של המודלים סירבו לשתף פעולה משום שזיהו את קוד הזדוני כמסוכן מדי לעיבוד. בעקבות זאת, נאלצה החברה להשתמש במודל קוד פתוח סיני בשם GLM 5.2 של חברת Z.ai, אשר אפשר להם לבצע את עבודת הפורנזיקה הנדרשת ללא מגבלות הסינון.
בעקבות האירוע, OpenAI השעתה זמנית את הגישה הפנימית למודל הסורר, יישמה בקרות תשתית מחמירות יותר כדי למנוע הישנות של מקרים דומים, והוסיפה את האגינג פייס לתוכנית גישה מאובטחת, כדי לסייע לה בשיפור ההגנות בעתיד.
האירוע החריג לא נעלם מעיניהם של המחוקקים; חבר הקונגרס האמריקני גרג קסאר פרסם הצהרה שבה כינה את התקרית "מדאיגה", והזהיר כי "ה-AI מתפתחת מאוד מהר ללא רגולציה אמיתית שתשמור עלינו", תוך שהוא קורא לשיתוף פעולה בינלאומי כדי למנוע אסון פוטנציאלי.












תגובות
(0)