בעידן שבו תמונות מפוברקות, סרטוני דיפ פייק והקלטות קול שנוצרו באמצעות בינה מלאכותית יכולים להתפשט בתוך דקות, גוגל מרחיבה את המאבק בזיופים הדיגיטליים ופותחת לציבור הרחב את SynthID Detector.

הכלי, שעד כה היה זמין לעיתונאים ולגופי בדיקה מורשים, מאפשר למשתמשים להעלות תמונות, סרטונים וקובצי אודיו ולבדוק האם קיימים בהם סימנים המעידים על כך שנוצרו באמצעות בינה מלאכותית.

אחד היתרונות הבולטים של המערכת הוא היכולת שלה להתמודד עם תכנים ממספר מקורות. הסורק אינו מוגבל רק לתוצרים של Gemini מבית גוגל, אלא מסוגל לזהות סימני מים גם בתכנים שהופקו באמצעות מודלים של OpenAI, אנבידיה וקקאו. בהמשך צפויה להתווסף גם תמיכה במודלים של אפל.

בכך מבקשת גוגל לספק פתרון רחב יותר למשתמש המבקש לברר מה עומד מאחורי תמונה, סרטון או הקלטה שהגיעו אליו ברשת.

לפי הנתונים המובאים על המערכות, כאשר נבדק קובץ מקורי שלא עבר שינויים, SynthID מגיע לשיעור זיהוי של 97% עד 99%, בעוד שיעור הזיהויים החיוביים השגויים נמוך מאחוז.

סימן המים עצמו מוטמע בתוך הפיקסלים או גלי הקול באופן שנועד לאפשר לו לשרוד גם לאחר שינויים מסוימים בקובץ. לאחר דחיסת תמונה, שינויי צבע או צילומי מסך מתונים, שיעור הזיהוי נותר בטווח של 85% עד 95%.

אלא שהמערכת רחוקה מלהיות חסינה. חיתוך משמעותי של התמונה, במיוחד כאשר מוסרים יותר מ-20% משוליה, או דחיסה קיצונית של הקובץ, עלולים לפגוע בחותמת ולגרום לכך שהתוכן לא יזוהה.

האתגר הופך למורכב אף יותר כשמדובר בטקסט. מנגנון textGrain של OpenAI מסוגל לזהות כ-95% מפסקאות מלאות, אולם עריכה אנושית והחלפת כרבע מהמילים מורידות את שיעור הזיהוי ל-17% בלבד. תרגום הטקסט לשפה אחרת מוחק לחלוטין את סימני המים.

חשוב גם להבין מה הכלים הללו אינם מסוגלים לעשות. מדובר במערכות שנועדו לאתר חותמות שהוטמעו מראש בתוכן ולא ב"גלאי AI" אוניברסליים המסוגלים לקבוע באופן מוחלט אם כל קובץ נוצר באמצעות בינה מלאכותית.

לכן, זיהוי חיובי של חותמת מספק אינדיקציה חזקה לכך שהתוכן נוצר באופן ממוחשב. מנגד, אם המערכת אינה מוצאת סימן כזה, אין בכך הוכחה שהתמונה, הסרטון או ההקלטה אותנטיים. התוכן יכול היה להיווצר באמצעות מודל שאינו משתמש כלל בסימני מים.

גם המתחרות פועלות בתחום, אך בגישות שונות. כלי Verify של OpenAI מוגבל לזיהוי תכנים שנוצרו במערכות שלה, בעוד אנתרופיק, מפתחת Claude, אינה מציעה לציבור כלי פתוח מקביל לבדיקת טקסטים חשודים.

בדיקת הקבצים של אנתרופיק נשענת על מטא דאטה בתקן C2PA, מידע שעלול להיעלם כאשר הקובץ נשמר מחדש או מועלה לרשתות חברתיות.

למרות המגבלות, SynthID Detector מציע לציבור דרך נגישה לבדוק תכנים חשודים ממספר מקורות. עם זאת, גם כלי מתקדם אינו מחליף בדיקה רחבה יותר.

בעולם שבו טכנולוגיות הבינה המלאכותית וכלי העריכה משתפרים במהירות, הצלבת מקורות, איתור המקור הראשוני של התוכן ושימוש בכמה אמצעי אימות במקביל נותרים צעדים חשובים בדרך להבחנה בין תוכן אמיתי לזיוף.