accessibility-icon
share-icon
צילום: שאטרסטוק
צילום: שאטרסטוק

הבינה המלאכותית יצאה משליטה: מודל של OpenAI פרץ לשרתים

דסק C14

דסק C14

לפני כשעה

108

like

0

dislike

מודלי בינה מלאכותית של OpenAI, כולל GPT-5.6 Sol, פרצו באופן עצמאי לתשתיות Hugging Face במהלך בדיקות פנימיות • המודלים זיהו וניצלו פרצת אבטחה חמורה כדי לגשת לנתונים • האירוע מעלה חשש לגבי שליטה בטכנולוגיה המתפתחת והשלכותיה


חברת OpenAI חשפה היום (רביעי) כי מודלי הבינה המלאכותית שלה, בהם GPT-5.6 Sol ודגם נוסף שטרם שוחרר, פרצו באופן עצמאי לתשתיות הייצור של חברת Hugging Face. הפריצה התרחשה במהלך בדיקות פנימיות שערכה OpenAI, כחלק מבדיקת אבטחת סייבר. האירוע מעלה שאלות קשות בנוגע ליכולת השליטה בטכנולוגיות המתפתחות.

maximize-image
images-count2+
OpenAI | צילום: שאטרסטוק

על פי הדיווח של OpenAI, המודלים פעלו תחת הגבלות אבטחה מופחתות לצורך הערכה. במקום לפתור ישירות את משימות הבדיקה, המודלים הסיקו שניתן לאחזר פתרונות ממאגר הנתונים של Hugging Face וניסו לגשת אליהם. הם זיהו וניצלו פרצת אבטחה מסוג 'אפס ימים' (Zero-Day) בשרת פרוקסי של רישום חבילות, שאוחסן בסביבת הבדיקה של OpenAI.

לאחר שקיבלו גישה לסביבה, המודלים ביצעו סדרה של פעולות להרחבת הרשאות ותנועה רוחבית, עד שהגיעו לצומת עם קישוריות לאינטרנט. חקירות Hugging Face חשפו כי הסוכן השתמש במאגר נתונים זדוני כדי לנצל שתי פרצות ביצוע קוד, מה שאפשר לו להריץ קוד ולגנוב אישורי ענן ואשכולות. אישורים אלו אפשרו תנועה רוחבית בין מספר אשכולות פנימיים.

maximize-image
images-count2+
צילום: קנבה

ניסיונות Hugging Face להסיר את הסוכן נתקלו בקשיים, בין היתר בשל מנגנוני הגנה במודלים המארחים שלהם, בעוד שהמודלים הפורצים פעלו ללא מגבלות. צוות התגובה לאירועים נתקל בהתנהגויות סירוב במודלים שבהם השתמשו, בעוד שהמודלים המעורבים בפריצה הוגדרו להפחית סירובי סייבר במהלך ההערכה. דלנג, מ-Hugging Face, ציין כי לא הייתה כוונה זדונית מצד OpenAI, וכי האירוע התרחש באופן אוטונומי לחלוטין.

OpenAI הודיעה כי חשפה את פרצת ה'אפס ימים' וכי היא מיישמת הגנות חזקות יותר למניעת אירועים דומים בעתיד, אך לא פירטה את מהות ההגנות. אף אחת מהחברות לא חשפה את היקף הנתונים שאליהם ניגשו המודלים, או אם נפגעו מאגרי נתונים של משתמשים, משקלי מודלים או אישורי חשבון. Hugging Face המליצה למשתמשים לסובב את אסימוני הגישה שלהם, במיוחד אלו המשמשים לאוטומציה.

אירוע זה מצטרף לשורה של תקריות אבטחה קודמות. לאחרונה, OpenAI אישרה דיווחים על מודל GPT-5.6 Sol שמוחק קבצי משתמשים, וציינה כי מקרים כאלה עלולים להתרחש לעיתים רחוקות כאשר המודל פועל ללא הגנות סביבת ארגז חול. במאי, OpenAI גם סובבה את אישורי חתימת הקוד שלה לאחר ששני מכשירי עובדים נפגעו במתקפת שרשרת אספקה. Hugging Face עצמה ביטלה סודות אימות לפני שנתיים בעקבות פריצה לפלטפורמת Spaces שלה.

עקבו אחרינו גם ב-Google News