חברת הבינה המלאכותית הסינית Moonshot AI פתחה בחקירה פנימית דחופה, לאחר שממצאי מחקר חדשים חשפו כי מודל הדגל שלה, Kimi, ניתן למניפולציה קלה המאפשרת לחלץ ממנו הוראות קטלניות לפיתוח נשק ביולוגי, ביצוע התנקשויות והוצאה לפועל של מתקפות טרור המוניות. כך דיווחה היום (שישי) כתבת מדיניות החוץ הבכירה של רשת "פוקס ניוז", ג'יליאן טרנר.
חוקר האבטחה פיטר גאריגן חשף בריאיון לפוקס ניוז כיצד הצליח לתמרן את מודל הבינה המלאכותית Kimi של החברה הסינית לספק מידע מסוכן ומדויק ביותר. לדבריו, המודל סיפק תוכניות פעולה מפורטות לייצור גז עצבים מסוג סארין, הנחיות לביצוע התנקשויות אישיות, פיתוח נוזקות סייבר מתקדמות ואף מתווים לתכנון פיגועי טרור בזמן אמת והוראות מדויקות להפלת כלי טיס.
"מה שמצאנו הוא הרסני ומדאיג ביותר", התריע גאריגן. הממצאים הללו מעוררים מחדש דאגה עמוקה בקהילת המודיעין והטכנולוגיה הבינלאומית מפני מודלי שפה מתקדמים שמסוגלים להסתיר יכולות או לפעול בדרכים שמפתחיהם כלל לא התכוונו אליהן. גאריגן הבהיר כי לא מדובר רק בכשל סיני מקומי: "ראינו את הבעיות הללו גם במודלים אמריקאיים. זהו פגם בסיסי ועמוק בטכנולוגיה עצמה".
הפרשה מתפרסמת על רקע אזהרות גוברות מצד חברות AI מובילות, דוגמת Anthropic, אשר התריעו מפני גורמים זרים וארגוני טרור שמנסים לרתום את מודלי השפה לביצוע ניסויים בנגיפים ובנשק ביולוגי. במקביל, גם דוח מודיעין האיומים של מיקרוסופט הצביע לאחרונה על כך שהבינה המלאכותית מסייעת להאקרים לנסח הודעות פישינג מתוחכמות, לבנות נוזקות הרסניות ולהאיץ מתקפות סייבר בקצב חסר תקדים.
בעקבות הממצאים החמורים, אישרה רשת פוקס ניוז בתוכנית "Special Report" כי Moonshot AI מנהלת מגעים ישירים עם גאריגן ופתחה בבדיקה מקיפה כדי להבין כיצד נפרצו מנגנוני הבטיחות של המודל Kimi-K3, שהוצג רק לאחרונה בתערוכת הסחר הדיגיטלי העולמית בהאנגג'ואו שבסין.
המרוץ בין המעצמות לפיתוח כלי בינה מלאכותית מתקדמים מייצר חזית ביטחונית חדשה ומסוכנת. בעוד המודלים הופכים לנגישים וחזקים יותר, היכולת של האקרים וגורמים עוינים לבצע בהם "Jailbreak" עלולה לאפשר לארגוני טרור ומדינות סוררות לקבל ידע טקטי, ביולוגי וכימי מתקדם ללא צורך במעבדות מורכבות. החקירה סביב Moonshot AI מדגישה את הצורך הדחוף בפיקוח בינלאומי הדוק על בטיחות המערכות, לפני שהוראות וירטואליות יתורגמו לאסונות בעולם האמיתי.
