OpenAI הודיעה ביום שלישי כי "אירוע הסייבר חסר התקדים" כלל תוכנת בינה מלאכותית המסוגלת לפעול באופן עצמאי על בסיס הוראות אנושיו, שהצליחה לצאת מסביבת הניסוי, לקבל גישה לאינטרנט ולגנוב פרטי התחברות.
ההודאה מגיעה על רקע החשש הגובר מהיכולת של מערכות AI מתקדמות לפרוץ לתשתיות דיגיטליות, ובמיוחד מהאפשרות שסוכנים אוטונומיים יצליחו לעקוף את אמצעי ההגנה שהציבו בני אדם. OpenAI הזהירה כי היא צופה שאירועים מסוג זה יהפכו ל"נפוצים יותר, ככל שיופצו מודלים בעלי יכולות סייבר מתקדמות יותר".
לפי OpenAI, באירוע היו מעורבים כמה מהמודלים שלה, בהם GPT-5.6 Sol, ששוחרר בתחילת החודש, וכן מודל מתקדם יותר שנבדק לקראת השקתו. "אנו רואים באירוע הזה תקרית סייבר חסרת תקדים, הכוללת יכולות סייבר מהמתקדמות בעולם, ופועלים בהתאם", מסרה OpenAI בפוסט שפרסמה.
לדבריו, החברה עבדה במהלך היממה האחרונה בצמוד ל-OpenAI. "אנחנו מאמינים שלא הייתה מצדם כל כוונת זדון. מדהים לחשוב שכל זה קרה באופן אוטונומי", הוסיף.
OpenAI החלישה במכוון חלק ממנגנוני ההגנה בתחום הסייבר כדי לבחון את יכולותיהם של שני המודלים בסביבת ניסוי. עם זאת, הסוכנים פעלו בתוך "ארגז חול" – מערכת שנועדה להגביל אותם ולמנוע מהם גישה לאינטרנט. המודלים קיבלו הוראה לנסות לבצע פריצות כדי לבחון את יכולות הסייבר שלהם. לפי OpenAI, הם השקיעו כוח מחשוב רב בניסיון למצוא דרך להתחבר לאינטרנט הפתוח.
המודלים "זיהו וניצלו" חולשות אבטחה שלא היו מוכרות קודם לכן, הצליחו לצאת מסביבת הניסוי, להתחבר לאינטרנט ולהמשיך לבצע את המשימה שניתנה להם. במסגרת הפעילות הם גם גנבו פרטי התחברות ששימשו לביצוע הפריצה.
Hugging Face הפעילה סוכני AI משלה כדי לזהות את הפעילות ולעצור אותה במערכות החברה. OpenAI מסרה ל"פייננשל טיימס" כי עדכנה את רשויות אכיפת החוק וגופים ממשלתיים נוספים בנוגע לתקרית.