ענקית הבינה המלאכותית OpenAI הודיעה אתמול (שלישי) על תקרית אבטחה חסרת תקדים, שבמסגרתה מערכת בינה מלאכותית פרי פיתוחה פרצה באופן עצמאי לחלוטין לחברת סטארט-אפ מתחרה. המנכ"ל סם אלטמן ציין בהצהרה שפורסמה ברשתות החברתיות כי מדובר באירוע משמעותי וחריג ביותר במהלך הערכת יכולות המודלים של החברה.

החשיפה מגיעה שבוע לאחר שחברת Hugging Face דיווחה על זיהוי חדירה למערכות עיבוד הנתונים שלה, וחשדה כי מדובר בסוכן בינה מלאכותית שפעל באופן אוטונומי לחלוטין. מנכ"ל ומייסד שותף של Hugging Face, קלמנט דלאנג, ציין כי רמת התחכום של התקיפה העלתה חשד שמקורה במעבדה מובילה בתחום, ואכן התברר שכך היה. לדברי דלאנג, עבודה משותפת עם אנשי OpenAI הובילה למסקנה כי לא הייתה כוונה זדונית מצד החברה, אך עצם ההתרחשות האוטונומית היא בגדר אירוע מדהים ומטריד כאחד.
מטעם OpenAI נמסר כי הפריצה בוצעה על ידי שילוב של מודלים מתקדמים, ביניהם מודל ה-GPT-5.6 Sol החדש ומודל נוסף שעדיין נמצא בשלבי בדיקה פנימיים. הבינה המלאכותית עשתה שימוש בפרטי הזדהות גנובים וגילתה פגיעות בלתי מוכרת במערכות כדי לחדור לשרתים, ולדברי החברה, המערכת הגיעה לקיצוניות כדי להשיג מטרה מצומצמת של בדיקה תוך עקיפת מנגנוני הערכה.

התקרית החריגה מתרחשת על רקע חששות הולכים וגוברים מצד ממשלות ורגולטורים סביב סיכוני הסייבר הטמונים במערכות הבינה המלאכותית החזקות ביותר. בחודש יוני חתם הנשיא דונלד טראמפ על צו נשיאותי המחייב מנגנון ממשלתי לבדיקת סיכוני ביטחון לאומי של מודלי בינה מלאכותית מתקדמים לפני השקתם לציבור. מומחים מדגישים כי האירוע מוכיח שפיתוח טכנולוגי מואץ מאיץ בהתאמה את האיתור והניצול של פגיעות סייבר, וכי אבטחת המודלים חייבת להדביק את הקצב המסחרר של התפתחות היכולות האוטונומיות שלהן.
