טקסטים שנכתבו באמצעות בינה מלאכותית עשויים בקרוב לשאת חתימה דיגיטלית שהקוראים לא יראו, אך כלי ייעודי יוכל לזהות. לפי הדיווח, OpenAI הודיעה על פריסת מנגנון סימון סמוי בתוצרים של ChatGPT וסביבת הפיתוח Codex במדינות האיחוד האירופי. בישראל, בשלב זה, הסימון אינו צפוי להיות מופעל.

המהלך מוצג בדיווח כחלק מההיערכות לדרישות השקיפות שבסעיף 50 לחוק הבינה המלאכותית האירופי. מטרתו היא לאפשר זיהוי ממוחשב של תוכן שנוצר באמצעות מערכות AI.

המנגנון, המכונה textGrain, אינו מוסיף לטקסט סמל או כיתוב גלוי. הוא מבוסס על מפתח סודי שמשפיע בעדינות על בחירת המילים של המודל. לאורך הטקסט נוצרת כך תבנית סטטיסטית, המשמשת חתימה שכלי זיהוי ייעודי יכול לאתר בהסתברות גבוהה.

לפי המתואר, השיטה דומה למנגנון SynthID של גוגל ולפתרון שהציגה אנתרופיק. הסימון אמור להשתלב בניסוח בלי לשנות את מבנה המשפט מבחינת הקורא.

אחת השאלות שנבחנו בפיתוח הייתה אם השפעה על בחירת המילים תפגע באיכות התשובות. על פי הדיווח, בבדיקות שערכה OpenAI במודל GPT-6 Astra התקבלו ציונים כמעט זהים עם הסימון ובלעדיו במשימות תכנות, אוטומציה ארגונית וידע מקצועי.

אלא שהיכולת לזהות את החתימה רחוקה מלהיות מוחלטת. לפי הנתונים המובאים, בטקסטים בתחום הפסיכולוגיה זוהו בהצלחה 95% מהפסקאות באורך 400 טוקנים, שהם כ־300 מילים. בפסקאות באורך 200 טוקנים ירד שיעור הזיהוי ל־80%. בתחומים שבהם אפשרויות הניסוח מוגבלות, כמו מתמטיקה ונוסחאות, יעילות הזיהוי נמוכה משמעותית.

גם עריכה של הטקסט עלולה להחליש את הסימון. בבדיקות המתוארות, החלפת 10% מהמילים במילים נרדפות הורידה את שיעור הזיהוי מ־92% ל־66%. כאשר הוחלף רבע מהמילים, השיעור ירד ל־17% בלבד.

על רקע המגבלות והחשש שטקסט אנושי יסומן בטעות כתוצר של בינה מלאכותית, נמסר כי הגלאי לא ייפתח בשלב זה לציבור הרחב. הגישה אליו תינתן באופן מבוקר לחוקרים ולארגוני בדיקה מוסמכים.

עבור מפתחים המשתמשים בממשק ה־API של החברה, הדיווח מתאר אפשרות להפעיל את הסימון לפי בחירה ברחבי העולם, כאשר ברירת המחדל תישאר כבויה. כך יוכלו חברות המשלבות את המודלים במוצרים שלהן לבחור אם לסמן את התוצרים.

לפי הדיווח, ההפעלה ב־ChatGPT וב־Codex תתבצע בשבועות הקרובים במדינות האיחוד האירופי בלבד. עבור המשתמשים בישראל, המשמעות היא שהטקסטים שיופקו בשירותים הללו לא יכללו בשלב זה את חתימת textGrain.