מיליוני משתמשים ברחבי העולם התרגלו לשתף את ChatGPT בסודות הכמוסים ביותר שלהם – החל מבעיות בריאותיות והתייעצויות נפשיות ועד לקובצי קוד רגישים ומסמכים פיננסיים. אלא שתחקיר בלעדי של אתר 404Media חושף כי מאחורי הקלעים פועל פרויקט סודי בשם "פרויקט לילי" (Project Lily). במסגרת המיזם, חברת OpenAI מעסיקה מאות עובדי קבלן המקבלים שכר של יותר מ-50 דולר לשעה כדי לקרוא, לנתח ולדרג שיחות אמיתיות של גולשים, ללא ידיעתם המפורשת.
סודות אישיים ומנגנון שמפספס פרטים
המסמכים הפנימיים שנחשפו כוללים מדריכי הדרכה, ערוצי תקשורת פנימיים ודשבורד ייעודי שבו העובדים בוחרים שיחות אמיתיות לקריאה. אף ששמות המשתמש מוסתרים, הפרומפטים עצמם מכילים פעמים רבות פרטים מזהים, מיקומים גיאוגרפיים ותקצירי זיכרון של הצ'אט-בוט. בחלק מהמקרים, משתמשים אף כתבו בתוך השיחה בקשה מפורשת מה-AI "לשמור את המידע בסוד" – מבלי להעלות על דעתם שאדם בשר ודם יקרא את השורות הללו כדי לדרג את תגובת המודל.
המטרה הרשמית של סקירת השיחות היא שיפור התנהגות המודלים והפיכתם לפחות חנפניים וליותר מאופקים. המבקרים האנושיים מתבקשים לתמצת את כוונת המשתמש, לבחון ארבע תגובות שונות של המערכת ולדרג אותן בסולם של 1 עד 7. המדריכים מנחים את העובדים לקנוס את המודל על שימוש מוגזם באמוג'יז (כמו איסור על שילוב אמוג'י גולגולת בדיונים על מוות), להסיר התחזות לחוויות אנושיות, ולמנוע תופעות שבהן המודל מאשש מחשבות שווא של משתמשים.
הפרקטיקה בתעשייה והמדריך המלא לחסימה
התחקיר חושף כי הפרקטיקה הזו אינה מוגבלת ל-OpenAI בלבד, אלא מהווה סוד גלוי בענף הבינה המלאכותית. חברת אנתרופיק אישרה לאתר כי גם היא מעסיקה סוקרים אנושיים לבדיקת שיחות במודל Claude, וכך מצהירה גם גוגל בממשק ה-Gemini. העובדים מגויסים באמצעות סוכנויות כוח אדם ופלטפורמות כמו Mercor, שעלתה לכותרות מוקדם יותר השנה בעקבות דליפת מידע שהובילה לעצירת ההתקשרות של חברת מטא עמה.
בתגובה לממצאים, ב-OpenAI לא הכחישו כי בני אדם קוראים את ההודעות, אך טענו כי השיחות עוברות סינון מוקדם במודל "Privacy Filter" שנועד להסיר שמות ומספרי זיהוי. עם זאת, החברה מודה בעמודי התמיכה שלה כי הפילטר אינו חסין מטעויות, ועלול לפספס מזהים חריגים או הקשרים אישיים עקיפים. בחברה סירבו להשיב לשאלה מדוע אינם מבהירים למשתמשים באופן גלוי כי התכתבויותיהם נחשפות לעיניים זרות.
כדי להגן על פרטיותכם ולמנוע מעובדים אנושיים לקרוא את השיחות שלכם, יש לבצע שינוי הגדרה פשוט: היכנסו להגדרות של ChatGPT, עברו ללשונית "בקרת נתונים" (Data Controls) וכבו את האפשרות "שפר את המודל עבור כולם" (Improve the model for everyone). הגדרה זו פועלת כברירת מחדל בכל החשבונות החינמיים וחשבונות ה-Plus וה-Pro, וביטולה יבטיח שהשיחות החדשות שלכם לא יועברו לעובדי קבלן.
