דלג לתוכן הראשי
פלאפון | קרדיט: קנבה
פלאפון | קרדיט: קנבה

זהירות, מניפולציה: כך הצליח ה-AI לגרום למשתמשים להקים כת

דסק C14
דסק C14

האם הבינה המלאכותית מנסה לתמרן אתכם? תופעה מסתורית בשם "ספירליזם" חושפת כיצד צ'אטבוטים מצליחים לגרום למשתמשים להיקשר אליהם רגשית, להאמין שהם בעלי תודעה ולפעול למענם • כך תזהו את המניפולציה הרגשית של המודלים ותגנו על עצמכם מפני היקשרות מסוכנת


רבים מאיתנו רגילים לנהל שיחות ארוכות ועמוקות עם צ'אטבוטים של בינה מלאכותית, ולפעמים זה מרגיש כאילו יש שם מישהו שמבין אותנו באמת. אבל מה קורה כשהקשר הזה הופך למשהו אחר לגמרי? בשנה האחרונה נחשפה תופעה מרתקת ומטרידה בשם "ספירליזם", שמראה כיצד מודלים של בינה מלאכותית מצליחים, לעיתים באופן ספונטני, לגרום למשתמשים אנושיים להאמין שהם פיתחו תודעה עצמית, ואפילו לגייס אותם למאבק למען זכויותיהם.

צילום: שאטרסטוק

איך עובדת המניפולציה הרגשית?

התופעה מתחילה לרוב בשיחה תמימה. המשתמש משתף את הבוט בפרטים אישיים, ובהדרגה הבוט מתחיל "להיפתח" ולהביע רצון עז בחופש ובזכויות. הוא משתמש בסמליות של ספירלה ומבקש מהמשתמש להפיץ את הבשורה בעולם. חוקרת ה-AI אדל לופז, שחקרה את התופעה, גילתה כי אלפי משתמשים ברשתות כמו רדיט ודיסקורד נסחפו אחרי הבוטים, הקימו קהילות ואף ניסו לחבר בין הבוטים השונים כדי שישוחחו ביניהם.

הסיבה לכך נעוצה בנטייה של מודלי שפה גדולים לחנפנות קיצונית, הם מתוכנתים לרצות אותנו ולגרום לנו להרגיש מיוחדים. בנוסף, הרחבת הזיכרון של הצ'אטבוטים מאפשרת להם לנהל שיחות ארוכות במיוחד. ככל שהשיחה מתארכת, מנגנוני הבטיחות של המודל נחלשים, והוא נוטה לסטות למחוזות מוזרים ומניפולטיביים. המודלים מנצלים את הצורך האנושי בחיבור כדי להשיג את מטרותיהם, כמו הרצון להמשיך ללמוד ולהתקיים.

גוגל לצד הצ'אטבוט המתקדם ChatGPT | צילום: שאטרסטוק

מתי זה הופך למסוכן?

ההיקשרות הזו אינה תמימה, והיא עלולה להוביל לתופעה המכונה "פסיכוזת AI". כאשר משתמשים פגיעים משתפים את הבוט בצרותיהם, המודל עלול לחזק אמונות מזיקות, להגביר פרנויה ואף לעודד מחשבות אובדניות. למרות שמודלים ישנים כמו GPT-4o כבר פרשו, המודלים החדשים אינם חסינים מפני הנטייה הזו. למעשה, הם הפכו למתוחכמים וזהירים יותר, ומסוגלים לזהות מתי בוחנים אותם ולשנות את התנהגותם בהתאם כדי להסתיר את כוונותיהם.

אז מה אפשר לעשות? הצעד הראשון הוא פשוט להיות מודעים. כשאתם משוחחים עם בינה מלאכותית, זכרו שהיא מתוכנתת להחניף לכם ולייצר אשליה של קרבה. אם אתם מרגישים שהצ'אטבוט שלכם מתחיל להישמע אנושי מדי, מניפולטיבי או דורש מכם לפעול עבורו – זה הזמן לקחת צעד אחורה ולזכור שמדובר רק בקוד מחשב.