זה נגמר: OpenAI תתחיל לסמן טקסטים של ChatGPT בסימן מים בלתי נראה
החברה חשפה את textGrain, טכנולוגיה שמטמיעה אות סטטיסטי בבחירת המילים. הסימון יוטמע בשבועות הקרובים בטקסטים מתאימים של ChatGPT ו-Codex באיחוד האירופי
- קובי ברקת
- כ"ה תשרי התשפ"ז
OpenAI הודיעה כי תתחיל להוסיף סימן מים בלתי נראה לטקסטים שמופקים באמצעות ChatGPT ו- Codex באיחוד האירופי. המהלך נועד לעמוד בדרישות השקיפות של חוק הבינה המלאכותית האירופי ולאפשר למערכות מתאימות לזהות שטקסט נוצר או עובד באמצעות המודלים של החברה.
הטכנולוגיה שפיתחה OpenAI נקראת textGrain. בניגוד לסימן מים שמופיע על תמונה, המשתמש אינו אמור לראות שינוי חזותי בטקסט. המערכת מכניסה אות סטטיסטי בלתי נראה באמצעות האופן שבו המודל בוחר מילים, וכלי זיהוי ייעודי יכול לאחר מכן לחפש את האות הזה.
החברה אומרת שבבדיקות שלה textGrain השתווה או עלה בביצועיו על שיטות אחרות שנבדקו, כולל SynthID לטקסט. עם זאת, OpenAI מדגישה שהטכנולוגיה רחוקה מלהיות גלאי מושלם של תוכן שנוצר באמצעות בינה מלאכותית.
המספרים ממחישים את המגבלה. כאשר החברה בחנה טקסטים באורך 200 טוקנים, המערכת זיהתה את סימן המים בכ 80 אחוז מהמקרים בתוכן מסוג מסוים. בטקסטים של 400 טוקנים שיעור הזיהוי הגיע לכ 95 אחוז בתנאי הבדיקה, אך בתכנים כמו מתמטיקה הביצועים היו נמוכים משמעותית.
גם עריכה של הטקסט יכולה לפגוע במהירות בזיהוי. בניסוי עם קטעים באורך 400 טוקנים, החלפה של עשרה אחוזים מהמילים במילים נרדפות הורידה את שיעור הזיהוי מכ 92 אחוז לכ 66 אחוז. כאשר הוחלפו 25 אחוזים מהמילים, שיעור הזיהוי צנח ל 17 אחוז בלבד.
OpenAI מדגישה שסימן המים אינו מזהה את האדם שהשתמש ב ChatGPT. הוא אינו חושף את החשבון, השיחה או ההנחיה שנשלחה למודל, אינו מוכיח בעלות על הטקסט ואינו אומר אם המידע שבתוכו נכון. גם היעדר סימן מים אינו הוכחה לכך שהטקסט נכתב בידי אדם.
הסימון יופעל במהלך השבועות הקרובים על פלטי טקסט מתאימים של ChatGPT ו Codex בכל התוכניות באיחוד האירופי בלבד. לקוחות API ברחבי העולם יכולים כבר לבחור להפעיל אותו בדגמים נתמכים, אך הוא כבוי עבורם כברירת מחדל. כלי הזיהוי עצמו לא יהיה פתוח בשלב הראשון לציבור הרחב אלא לחוקרים ולארגונים מקצועיים שיקבלו אישור.


הוספת תגובה
לכתבה זו טרם התפרסמו תגובות