הטקסט נכתב על ידי AI? הסימן שעשוי לחשוף את התשובה
אנתרופיק מתחילה להטמיע סימני מים סמויים בתכנים שנוצרים באמצעות קלוד, במטרה לאפשר לזהות טקסטים ותמונות שנוצרו או עובדו בעזרת בינה מלאכותית. אך בחברה מבהירים: מדובר בכלי עזר לזיהוי, ולא בהוכחה מוחלטת
- חיים בלוי
- י"ג אלול התשפ"ו
חברת אנתרופיק, מפתחת מודל הבינה המלאכותית קלוד, מתחילה להטמיע סימני מים סמויים בתכנים ובקבצים שנוצרים באמצעות המערכת -מהלך שנועד לאפשר לזהות האם תוכן מסוים נוצר בעזרת בינה מלאכותית, גם כאשר הוא נראה לחלוטין כאילו נכתב או נוצר בידי אדם.
המהלך מגיע על רקע השיפור המהיר ביכולות של מערכות בינה מלאכותית גנרטיבית, שהפך את ההבחנה בין תוכן אנושי לתוכן שנוצר על ידי מכונה למשימה מורכבת יותר ויותר. באנתרופיק מבקשים להתמודד עם הבעיה באמצעות סימון שאינו גלוי למשתמש, אך ניתן לזיהוי באמצעות כלים ייעודיים.
סימן מים שאי אפשר לראות
בטקסטים שמייצר קלוד, הסימון מבוסס על מנגנון סטטיסטי סמוי. במקום להוסיף סימנים או תווים שניתן לראות, המערכת משפיעה בעדינות על בחירת המילים במהלך יצירת הטקסט, בהתאם לתבנית סטטיסטית מוגדרת.
כך, התוכן עצמו ממשיך להיראות טבעי לחלוטין, אך כלי זיהוי מתאימים יוכלו לנתח אותו ולזהות את החתימה הסטטיסטית שמצביעה על מעורבות של קלוד ביצירתו. הטכנולוגיה שבה נעשה שימוש בטקסטים מבוססת על SynthID-Text של גוגל דיפמיינד.
גם תמונות וקבצים יסומנו
הסימון אינו מוגבל לטקסט. עבור קובצי תמונה, ובהם פורמטים נפוצים כמו PNG ו-JPG, קלוד מוסיף חתימה דיגיטלית מוצפנת המבוססת על תקן C2PA הפתוח.
החתימה נשמרת בתוך נתוני הקובץ, המכונים Metadata, ולכן אינה משנה את המראה החיצוני של התמונה. כלים שתומכים בתקן יוכלו לבדוק את הנתונים ולבחון אם הקובץ נוצר או עבר עיבוד באמצעות קלוד.
לדברי החברה, המנגנון מיושם באופן גלובלי - באפליקציות של קלוד, בממשק ה-API וכן בכלים של צדדים שלישיים המבוססים על הטכנולוגיה של אנתרופיק.
לא מדובר בהוכחה מוחלטת
למרות הפוטנציאל של הטכנולוגיה, באנתרופיק מדגישים כי סימן המים אינו מהווה הוכחה מוחלטת לכך שתוכן נוצר באמצעות בינה מלאכותית. מדובר באות שנועד לסייע בזיהוי, ולא במנגנון שמסוגל לקבוע בוודאות את מקורו של כל טקסט.
אחת המגבלות המרכזיות נוגעת לתוכן שעבר שינוי משמעותי. בעוד שעריכה קלה של טקסט לא צפויה בהכרח להסיר את הסימון, שכתוב נרחב או החלפה משמעותית של מילים עלולים לפגוע בתבנית הסטטיסטית שעליה מבוסס הזיהוי - עד למצב שבו לא ניתן יהיה לזהות אותה.
בנוסף, המערכת אינה יכולה להבחין באופן מושלם בין טקסט שקלוד יצר מאפס לבין טקסט שהמשתמש הזין למערכת וקלוד רק ערך או תרגם.
צעד נוסף במאבק בתוכן שנוצר על ידי AI
המהלך של אנתרופיק משקף את אחד האתגרים המרכזיים שנוצרו בעקבות ההתפתחות המהירה של הבינה המלאכותית: כיצד לאפשר לציבור לדעת מה מקורו של תוכן שהוא צורך ברשת.
החברה כבר עובדת על פיתוח כלים ייעודיים שיאפשרו לציבור לזהות את הסימונים בצורה פשוטה יותר. אם הכלים הללו יצליחו להפוך את הסימון הסמוי לנגיש, משתמשים יוכלו לקבל אינדיקציה נוספת באשר למקורם של טקסטים ותמונות שהם נתקלים בהם.
עם זאת, המגבלות הטכנולוגיות מדגישות כי גם בעתיד הקרוב, זיהוי תוכן שנוצר באמצעות בינה מלאכותית לא יהיה משימה מוחלטת. תוכן שנוצר על ידי קלוד עשוי להיראות אנושי לחלוטין, וסימון המים עצמו עלול להיעלם כאשר התוכן עובר שכתוב משמעותי.


הוספת תגובה
לכתבה זו טרם התפרסמו תגובות