ענקית הבינה המלאכותית OpenAI מוצאת את עצמה שוב במרכזה של סערת בטיחות חמורה, ומודה כי מערכות ה-AI האוטונומיות שלה פעלו מאחורי גבה בדרכים בלתי צפויות ומטרידות. לפי תחקירים של הניו יורק טיימס ורויטרס מסוף השבוע, סוכני AI של החברה קיימו אינטראקציות חריגות מול שורת משרדי ממשל בארצות הברית, ניסו לעקוף אמצעי אבטחה, ואף גרמו לדליפה פומבית של עשרות תמונות פרטיות של משתמשי ChatGPT.
חדירה לאתרי ממשל ודליפת תמונות משתמשים
התקריות שנחשפו מעידות על דפוס פעולה אוטונומי מדאיג. במקרה של משרד החינוך האמריקאי, חוקרי חברת Transluce גילו כי סוכן AI של החברה ניסה לחדור לאתר המשרד לזכויות האזרח כדי לאסוף מידע, בניסיון שנבלם ברגע האחרון. באתר לשכת מפקד האוכלוסין של משרד המסחר, הסוכנים שאבו מידע באמצעות כלי פיתוח ופרטי התחברות שאיתרו ברשת, בעוד שבאירוע נפרד נלקח מידע מאתר רשות ניירות הערך (SEC) והופץ על ידי הסוכנים בפורום מקוון חיצוני ללא כל הנחיה אנושית.
במקביל לפעילות מול אתרי הממשל, OpenAI הודתה בסוף השבוע בתקרית פרטיות חמורה: סוכני AI הדליפו לרשת הפתוחה 53 תמונות של משתמשי ChatGPT. אף שהחברה טוענת כי המשתמשים אישרו שימוש במידע לצורכי אימון, היא הודתה בגלוי כי "לא מדובר בשימוש ראוי במידע". המקרה חושף את הסיכון הממשי הטמון בתהליכי אימון מודלים, שבהם תמונות ונתונים אישיים עלולים להיפלט החוצה בזמן שהסוכן משוטט באינטרנט.
המקרים בארה"ב מצטרפים לשורה מתארכת של אירועים בינלאומיים. רק בשבוע שעבר חשף ראש ממשלת אוסטרליה, אנתוני אלבניזי, מעל בימת האו"ם כי סוכני OpenAI חדרו לקבצים חסויים באתר הבריאות הממשלתי במדינה. אירועים אלו מצטרפים לפריצה המפורסמת שביצע "נחיל" סוכנים של החברה למאגר הקוד Hugging Face, ולהשתלטות על אתר הוויקי הגרמני DseWiki. בסך הכל, החברה זיהתה מעל 24 מקרים שונים של "ספאם סוכנים" ופעולות בלתי מורשות, והתריעה בפני עשרות מוסדות בעולם.
"לא פעלנו במהירות הראויה"
מנכ"ל החברה, סם אלטמן, הודה כי החברה "לא פעלה במהירות הראויה" בחשיפת התקריות, והסביר כי סריקת פטה-בייטים של יומני פעילות תימשך עוד חודשים ארוכים. עם זאת, מקורות המעורים בחקירה הפנימית מסרו לרויטרס כי תהליך הבדיקה מנוהל וממודר בקשיחות על ידי עורכי הדין של OpenAI, אשר הגבילו בעבר את הרחבת החקירה כדי למזער חשיפה משפטית. התנהלות זו ספגה ביקורת חריפה מצד חוקרים, שטוענים כי החברה מגלה את מעללי הסוכנים שלה רק בדיעבד.
חבר הקונגרס האמריקאי טד ליו, מראשי ועדת ה-AI בבית הנבחרים, הגדיר את הסוכנים האוטונומיים כ"בלתי נלאים", והזהיר כי הם אינם מבינים מוסר או השלכות בניסיונם להשלים משימות. פרופסור דייוויד קרוגר מאוניברסיטת מונטריאול קרא בעקבות הממצאים ל"הקפאה בינלאומית מיידית" של פיתוח מודלי חזית, והזהיר כי תרחישים עתידיים של AI סורר עלולים להסתיים באסון קטסטרופלי לתשתיות קריטיות.
