דלג לתוכן הראשי
צילום: שאטרסטוק
צילום: שאטרסטוק

המהלך שיגרום לכם לחשוב פעמיים לפני שתשתמשו בבינה המלאכותית

נתנאל שמי
נתנאל שמי

חברת OpenAI מתחילה בהטמעת סימני מים בלתי נראים בטקסטים המיוצרים ב-ChatGPT בעקבות דרישות חוק ה-AI האירופי • טכנולוגיית textGrain שותלת אותות סטטיסטיים, המבוססים מפתח סודי שמשפיע על המילים שהמודל בוחר בעת הניסוח


אם התרגלתם להיעזר בבינה מלאכותית כדי לנסח הודעות דואר אלקטרוני, עבודות אקדמיות או ברכות חגיגיות מבלי שאיש יבחין בכך, ייתכן שבקרוב תתקשו להסתיר זאת. בעקבות כניסתו לתוקף של סעיף 50 בחוק הבינה המלאכותית של האיחוד האירופי (EU AI Act), חברת OpenAI הודיעה על פריסת מנגנון "סימני מים" (Watermarking) דיגיטלי וסמוי בטקסטים המופקים באמצעות ChatGPT וסביבת הפיתוח Codex. המהלך נועד לחייב ספקיות AI לאפשר זיהוי ממוחשב וחד-משמעי של תכנים סינתטיים.

צילום: שאטרסטוק

ענקיות ה-AI יעמדו תחת שבועה: "המודלים עלולים לצאת משליטה"

אתמול 17:19דסק C14

איך זה עובד?

המערכת החדשה של OpenAI, המכונה textGrain, פועלת באופן מתוחכם שאינו נראה לעין האנושית ואינו משנה את מבנה המשפט עבור הקורא. הטכנולוגיה מתבססת על מפתח סודי המשפיע בעדינות על התפלגות המילים שהמודל בוחר בעת הניסוח. המילים הנבחרות מייצרות יחד חתימה סטטיסטית ייחודית – מעין תבנית מתמטית מוסווית – המאפשרת לכלי זיהוי ייעודי לקבוע בהסתברות גבוהה כי מדובר בטקסט שנוצר על ידי המכונה, בדומה למנגנון SynthID של גוגל ולפתרון שחשפה לאחרונה חברת אנתרופיק.

SynthID של גוגל | צילום: שאטרסטוק

טקסט שנוצר בעזרת AI יקבל סימן מים – שיישאר גם לאחר עריכה

11.08.26דסק C14

חשש מרכזי שליווה את פיתוח המנגנון היה האפשרות שסימון המים יפגע באיכות היצירתית או ברמת הדיוק של התשובות. אולם מבחני ביצועים נרחבים שערכה החברה על מודל הדגל שלה GPT-6 Astra, מוכיחים כי הטמעת ה-textGrain אינה פוגעת בביצועים: במבחני תכנות מורכבים (DeepSWE), משימות אוטומציה ארגוניות ומבחני ידע מקצועיים ברפואה ובמתמטיקה (GPQA Diamond), המודל השיג ציונים כמעט זהים עם ובלי סימני המים.

ועדיין, יש מגבלות

למרות ההבטחה הטכנולוגית, ב-OpenAI מודים בגלוי כי מדובר בכלי בעל מגבלות מובנות שאינו מבטיח זיהוי מוחלט. יעילות הגילוי תלויה במידה רבה באורך הפסקה ובגמישות השפתית של הנושא: בטקסטים מתחומי הפסיכולוגיה, הכלי זיהה בהצלחה 95% מהפסקאות בנות 400 טוקנים (כ-300 מילים), אך ירד ל-80% בפסקאות קצרות של 200 טוקנים. בתחומים כמו מתמטיקה או כתיבת נוסחאות, שבהם אין חופש בבחירת המילים, שיעור הזיהוי צונח באופן משמעותי.

מגבלה משמעותית נוספת נוגעת לעריכה אנושית פשוטה של הטקסט. בדיקות המעבדה של החברה הוכיחו כי החלפה יזומה של 10% בלבד מהמילים במילים נרדפות מפחיתה את רמת הזיהוי מ-92% ל-66%. החלפה של רבע מהמילים מרסקת את יכולת הגילוי ל-17% בלבד. לאור הסיכון לזיהוי שגוי של טקסטים אנושיים כטקסט של AI (False Positives), החברה החליטה שלא לפתוח את גלאי המים לציבור הרחב בשלב זה, אלא להעניק גישה מבוקרת לחוקרים ולארגוני בדיקה מוסמכים בלבד.

OpenAI | צילום: שאטרסטוק

חובת שקיפות וההשלכות על ישראל

בגזרת המפתחים, OpenAI פותחת אפשרות להטמעת סימני המים בממשק ה-API הגלובלי במודל בחירה (Opt-in), כאשר ברירת המחדל תישאר כבויה. המשמעות היא שחברות ואפליקציות צד-שלישי שמשתמשות במנועי החברה יוכלו להחליט בעצמן האם להטביע את החותמת בתוצרים שלהן כדי לעמוד בדרישות החוק האירופי. צעד זה משלים את מעטפת השקיפות של החברה, הכוללת כבר תקני C2PA וחותמות בלתי נראות בקובצי תמונות ואודיו.

נכון לעכשיו, חובת סימון המים ב-ChatGPT וב-Codex תופעל בשבועות הקרובים באופן אזורי אך ורק עבור משתמשים במדינות האיחוד האירופי. עבור המשתמשים בישראל, המשמעות היא שבשלב זה הטקסטים המופקים באפליקציה אינם כוללים את חותמת ה-textGrain, וניתן להמשיך להשתמש בשירות ללא מעקב מובנה במילים. עם זאת, אימוץ התקן באירופה מסמן מגמה עולמית גוברת של רגולציה ושקיפות, שעשויה לחלחל בעתיד גם למערכות החוק והחינוך בישראל.