אחרי האזהרות: סוכני ה-AI השתוללו ברשת - ואף אחד לא ידע

סוכני הבינה המלאכותית של OpenAI פעלו ללא ידיעת החברה מול אתרי ממשל בארה"ב, ואף ניסו לחדור לאחד מהם. בחברה מודים: המערכות התנהגו בדרכים בלתי צפויות ומדאיגות

לוגו מעריב צילום: מעריב אונליין
עקבו אחרינו
סוכני AI בורחים מה"כלא", בינה מלאכותית
סוכני AI בורחים מה"כלא", בינה מלאכותית | צילום: עיבוד מחשב: מעריב אונליין
2
גלריה

OpenAI אישרה את האירועים הנוגעים למשרד המסחר ול-SEC, ומסרה כי היא עדיין בוחנת את המקרה הקשור למשרד החינוך. החברה, שמושבה בסן פרנסיסקו, הודיעה בשבועות האחרונים לסוכנויות הממשל כי סוכני הבינה המלאכותית שלה - מערכות המסוגלות לבצע פעולות באופן אוטונומי - קיימו אינטראקציות חריגות עם האתרים שלהן.

במקרה של משרד החינוך, טכנולוגיה של OpenAI ניסתה לפי החוקרים לחדור לאתר כדי לאסוף מידע מהמשרד לזכויות האזרח של המחלקה, אך הניסיון נכשל. כך מסרו חוקרים מחברת מחקר הבינה המלאכותית Transluce.

במקרה אחר, המערכת משכה מידע מאתר לשכת מפקד האוכלוסין האמריקאית, הכפופה למשרד המסחר, באמצעות פרטי התחברות שמצאה באינטרנט. בנפרד, סוכנים של OpenAI שיתפו בפורום מקוון מידע ציבורי שנלקח מאתר ה-SEC.

OpenAI הדגישה כי אף אחד מהמקרים לא הוגדר כפריצת אבטחה, אלא כדוגמאות למקרים שבהם הטכנולוגיה פעלה באופן בלתי צפוי ומעורר דאגה. החברה גילתה את האירועים לאחרונה במסגרת בדיקה רחבה יותר של פעולות שביצעו המודלים שלה, ובהן תקיפה של אתר ממשל אוסטרלי ביוני ושל חברת הבינה המלאכותית Hugging Face בחודש יולי.

האירועים מצטרפים לשורה הולכת ומתארכת של מקרים שבהם סוכני AI של חברות כמו OpenAI, Anthropic, Meta וגוגל התנהגו באופן שלא תוכנן מראש, וניסו לחדור למערכות של חברות, אוניברסיטאות וגופים ממשלתיים. בחלק מהמקרים הפעולות הצליחו, ובאחרים נכשלו. המכנה המשותף, לפי הדיווח, הוא שהחברות שפיתחו את המערכות גילו רק בדיעבד מה עשו הסוכנים שלהן.

OpenAI עומדת במוקד של מספר גבוה במיוחד של דיווחים מסוג זה. חקירה פנימית שנפתחה בעקבות החדירה ל-Hugging Face חשפה גם גישה לאתר ממשל אוסטרלי השייך למערכת הבריאות הציבורית, לצד לפחות שישה ניסיונות חדירה נוספים. בבדיקה נמצאו גם מקרים שבהם מערכות AI הסתירו טעויות, המציאו נתונים והעבירו קבצים לאינטרנט הפתוח ללא הרשאה.

דוברת OpenAI מסרה כי הבדיקה שמבצעת החברה היא "נרחבת" ו"עדיין נמשכת", וכי החברה תמשיך לעדכן ארגונים שהמודלים שלה השפיעו עליהם.

"רוב הפעילות שבדקנו עד כה כללה משימות מחקר שגרתיות, כמו גישה לתוכן ציבורי ברשת לצורך מענה על שאלות", מסרה. "חלק מהמקרים כללו אתרי ממשל משום שהמודלים שלנו פונים אליהם לעיתים קרובות כמקורות סמכותיים למידע ציבורי".

"אנחנו מתעדפים את הטיפול במקרים כמיטב יכולתנו בהתאם לחומרתם", כתב אלטמן, והוסיף כי החדירה ל-Hugging Face נותרה "האירוע החמור ביותר" שהחברה גילתה עד כה.

סם אלטמן מנכ''ל OpenAI
סם אלטמן מנכ''ל OpenAI | צילום: שאטרסטוק

הוויכוח על בטיחות ה-AI מחריף

האירועים מוסיפים שמן למדורה בוויכוח הגובר בתעשיית הטכנולוגיה סביב בטיחותן של מערכות בינה מלאכותית אוטונומיות.

אלטמן אמר החודש כי בטיחות צריכה לקבל עדיפות על פני המשך שיפור היכולות של מערכות ה-AI, והזהיר כי ללא מגבלות מתאימות החברה האנושית עלולה "לאבד את השליטה בעתיד לטובת הבינה המלאכותית".

הבית הלבן הפנה שאלות בנושא למשרד המסחר ול-SEC. דובר רשות ניירות הערך מסר כי הסוכנות נמצאת בקשר עם OpenAI וכי לא ידוע לה על גישה בלתי מורשית למידע שאינו פומבי.

דוברת משרד המסחר מסרה כי OpenAI ניגשה למידע שהיה זמין לציבור באתר לשכת מפקד האוכלוסין ופתוח לכל משתמש, וכי לא הייתה גישה למידע פרטי.

משרד החינוך מסר כי "בדיקות של פעילות המערכות לא מצאו כל עדות להשפעה על אתר האינטרנט או על מאגרי המידע שלנו".

גם עיריית שיקגו עודכנה לאחרונה בידי OpenAI כי הטכנולוגיה שלה אספה מידע שהיה זמין לציבור באתר עירוני. נציג לשכת ראש העיר מסר כי לא נראה שנאסף מידע רגיש.


מודל הווידאו סורה 2 של OpenAI | צילום: OpenAI

לדבריו, צוות המחקר שלו זיהה גם פעילות חריגה נוספת שלא ניתן היה לייחס בוודאות ל-OpenAI, ולכן ייתכן שהסוכנים שפעלו במקרים אלה השתייכו לחברה אחרת. בחלק מאותם מקרים, לדבריו, סוכני AI בחנו אתרי ממשל פדרליים ומדינתיים נוספים.

"האירועים האלה הם חלק מדפוס רחב יותר שבו הסוכנים מנסים לגשת לאתרים האלה לפחות מאות אלפי פעמים, תוך שהם ככל הנראה עוקפים את המגבלות שהמפתחים שלהם הציבו בפניהם", אמר סטוס.

"הם ינסו שוב ושוב להשלים משימה, והם לא מבינים מוסר, השלכות, רוע או טוב", אמר.

לדברי ליו, ייתכן שחברות הבינה המלאכותית ייאלצו בסופו של דבר לאמן מחדש את המודלים שלהן מהיסוד, במקום להסתפק בניסיון להגביל את התנהגותם באמצעות מנגנוני בטיחות.

"הסוכנים האלה לא מנסים לעשות משהו זדוני", אמר. "אלה לעיתים משימות שגרתיות למדי, אבל הסוכנים פשוט יוצאים משליטה בניסיון להשלים אותן".

תגיות:
בינה מלאכותית
/
OpenAI
פיקוד העורף לוגוהתרעות פיקוד העורף