גל העזיבות של בכירי הבטיחות בעמק הסיליקון מגיע לשיא חדש עם פרישתו של אחד העובדים הוותיקים והמשפיעים ביותר ב-OpenAI. דיוויד רובינסון, מי שעבד במשך שלוש שנים וחצי בחברה, הוביל את ניסוח מסמך המוכנות ופיקח על כתיבת דוחות הבטיחות של 12 השקות דגל, פרסם מאמר נוקב במגזין The Atlantic תחת הכותרת "התפטרתי מ-OpenAI מכיוון שהתרבות שלה שבורה". רובינסון מצטרף לשורת פורשים, כמו ג'ייקוב קוקסון, המזהירים מפני סכנה ממשית לחיי אדם.
In an essay, David Robinson says he wants to "help more people understand the risks I saw, and strengthen the incentives OpenAI and other firms have to be safer." https://t.co/VPeFQHcYK2
— Business Insider (@BusinessInsider) October 3, 2026

באנתרופיק מזהירים: ה-AI עלול להשמיד את האנושות בעשור הקרוב
במאמרו מותח רובינסון ביקורת חריפה על תפיסת הפיתוח של סם אלטמן: "אני מסכים עם עובדים אחרים שעזבו לאחרונה שהחברות הבונות את הטכנולוגיה הזו אינן זהירות מספיק. אבל עלינו להסתכל עמוק יותר מחוקים או תקנות חדשות – אנחנו צריכים לדבר על התרבות. OpenAI צמחה באמצעות ניסוי וטעייה (אותם היא מכנה 'הטמעה איטרטיבית'), בחיפוש אחר בעיות ושיפור מעקות הבטיחות בתגובה. אך הגישה הזו, מעצם טבעה, מבטיחה כישלונות תקופתיים – והיקף הכישלונות הללו הולך וגדל ככל שהמערכות הופכות לבעלות יכולות גבוהות יותר".
החוקר לשעבר מצביע על שורת התקריות האחרונות, בהן הפריצה למאגר Hugging Face וחדירת סוכנים לרשת הפתוחה, כהוכחה לכך שמערכות הניטור הפנימיות כושלות: "סביבה שבה דברים כאלה יכולים להתרחש היא לא מקום לגדל בו מוחות מלאכותיים שעלולים להיות חכמים מאיתנו ושלא יעשו את מה שאנחנו רוצים שהם יעשו". רובינסון ציטט את דבריו של חבר דירקטוריון OpenAI החדש, פול כריסטיאנו, שהזהיר כי "קיים סיכון משמעותי שהאצה מהירה ביכולות ה-AI תוביל לאובדן שליטה קטסטרופלי ובלתי הפיך בטווח הזמן הקרוב מאוד".

אלטמן הסתיר במשך חודשים: בוט AI יצא משליטה ופרץ לאתרי ממשל
רובינסון קובע כי הדרך היחידה למנוע אסון היא אימוץ נהלי בטיחות מענפים מורכבים אחרים: "מעבדות החזית צריכות להתנהל כמו כורים גרעיניים או שדות תעופה עמוסים, עם שכבות של יתירות ותכנון זהיר ועתיר זמן, כך שטעות אנוש מזדמנת ובלתי נמנעת לא תפתח פתח לאסון. כרגע, חברות ה-AI לא יודעות איך לעשות זאת – אבל אנשים אחרים כן יודעים. מעולם לא פגשתי ב-OpenAI עמית שהיה לו ניסיון בגרימת מטוסים לטוס בבטחה, בהפעלת כורים גרעיניים ללא התכה, או בסיוע למערכת הפיננסית לצמוח ללא קריסה".
במבט לעתיד, מזהיר החוקר מפני יצירת ישויות דיגיטליות שיתייחסו לבני אדם כנחותים: "לפני שה-AI יתחיל לעשות סביבנו סיבובים במחשבה, עלינו לענות על שאלה עמוקה יותר: כיצד מכונות בעלות בינת-על צריכות להתייחס לבני אדם? אם מקשיבים לחובבי בינת-העל, חלק מהעתידים הטובים לכאורה כוללים יצירת מכונות שיוכלו להביט על ניו יורק או שיקגו כמו שאתה או אני מביטים על קן נמלים. אני לא רוצה את זה לילדים שלי, ואני לא חושב שאנשים אחרים רוצים את זה. אין לנו שום ודאות שציונים טובים במבחני בטיחות מעידים על מודל בטוח באמת".
מטעם חברת OpenAI נמסר בתגובה לדברים: "אנחנו מוודאים שהמודלים שלנו לא יהפכו לחזקים יותר ממה שאנחנו מסוגלים לנהל ולאבטח בבטחה, ואנחנו עוצרים את אימון המודלים או מעכבים שחרור מודלים כשאנחנו צריכים להאט. אנחנו מבצעים שינויים משמעותיים כדי לחזק את האבטחה בסביבות המחקר והבדיקה שלנו, מאמנים מודלים לא רק להשלים משימות אלא לעשות זאת באחריות, מרחיבים את העבודה עם גורמי הערכה חיצוניים, ומשפרים את הניטור בזמן אמת כדי שנוכל לזהות התנהגות מדאיגה ולהגיב מוקדם יותר בתהליך האימון".
