האם הטקסט שאתם קוראים ברשת נכתב על ידי אדם או שמא מדובר ביצירה של בינה מלאכותית? עם הזינוק המטורף באיכות התוכן הגנרטיבי, כמעט בלתי אפשרי להבחין בהבדל.
כעת, חברת אנתרופיק, המפתחת של הצ'אטבוט הפופולרי קלוד (Claude), מובילה מהלך דרמטי שישנה את חוקי המשחק ויאפשר לכם לדעת בדיוק מי עומד מאחורי המילים והתמונות שאתם רואים במסך.

איך עובד סימן המים הסמוי?
החברה החלה להטמיע סימן מים סטטיסטי סמוי בטקסטים, וחתימה דיגיטלית מוצפנת בקבצים כמו תמונות. בטקסטים, השיטה מבוססת על טכנולוגיית SynthID-Text של גוגל דיפמיינד. במקום להוסיף תווים נסתרים, המערכת משפיעה בעדינות על בחירת המילים של קלוד לפי תבנית סטטיסטית ייחודית.
עוד באותו הנושא
הטקסט נראה טבעי לחלוטין, אך כלי זיהוי ייעודיים יוכלו לקרוא את החתימה הנסתרת הזו ולדעת שקלוד היה מעורב בכתיבה.

עבור קבצי תמונה כמו PNG או JPG, קלוד יוסיף חתימה מוצפנת לפי תקן C2PA הפתוח. החתימה נשמרת בנתוני הקובץ (Metadata) מבלי לשנות את המראה שלו, ומאפשרת לכל כלי תומך לבדוק אם התמונה עברה תחת ידיו של קלוד. הסימון מיושם באופן גלובלי בכל מקום שבו קלוד פועל, כולל האפליקציות שלו, ממשק ה-API וכלים של צד שלישי המבוססים עליו.
האם אפשר לעקוף את הסימון?
למרות החדשנות, באנתרופיק מודים כי סימני המים הם רק אותות ולא הוכחה חותכת. המערכת אינה מסוגלת להבחין בין טקסט שקלוד כתב מאפס לבין טקסט שהוא רק ערך או תרגם עבורכם.
בנוסף, בעוד שעריכה קלה לא תמחק את סימן המים, שכתוב מסיבי של הטקסט או החלפת מילים נרחבת יעלימו את התבנית הסטטיסטית לחלוטין ויהפכו את הזיהוי לבלתי אפשרי.

המהלך הזה, שנולד בעקבות חוק הבינה המלאכותית של האיחוד האירופי, הוא צעד חשוב במלחמה בזיופים ובחוסר השקיפות ברשת. החברה כבר עובדת על פיתוח כלי בדיקה ייעודיים שיאפשרו לציבור הרחב לזהות את הסימונים הללו בקלות. עד אז, זכרו שלא כל מה שנראה אנושי אכן נכתב על ידי בני אדם.