× הורדה
בחדרי חרדים
האפליקציה
ד' תשרי התשפ"ז
15.09.2026
מה שניתן לעשות

תחקיר חושף: עובדים קוראים שיחות של משתמשי ChatGPT

מאות קבלנים וסוקרים אנושיים של OpenAI בוחנים שיחות אמיתיות של משתמשי ChatGPT במסגרת תהליך שנועד לשפר את מודלי הבינה המלאכותית | כך תוכלו לצמצם את השימוש בשיחות שלכם לצורכי אימון

תחקיר חושף: עובדים קוראים שיחות של משתמשי ChatGPT
ChatGPT צילום: OpenAI

תחקיר חדש חושף כיצד שיחות של משתמשי ChatGPT מגיעות לעיניהם של סוקרים אנושיים במסגרת תהליך שמטרתו לשפר את התנהגות מודלי הבינה המלאכותית. לפי התחקיר, מאות עובדי קבלן מועסקים בפרויקט פנימי של OpenAI, שבמסגרתו הם נדרשים לקרוא, לנתח ולדרג שיחות ופרומפטים שנכתבו על ידי משתמשים.

החשיפה, שפורסמה באתר 404 Media, עוסקת בפרויקט פנימי המכונה “Project Lily”. במסגרת העבודה, הסוקרים מקבלים גישה לשיחות אמיתיות של משתמשי ChatGPT ובוחנים את האופן שבו המודל מגיב לבקשות השונות. לפי הדיווח, חלק מהקבלנים משתכרים יותר מ-50 דולר לשעה עבור העבודה.

היקף המידע שנחשף בפני הסוקרים עשוי להיות משמעותי במיוחד, משום שמשתמשים רבים אינם מתייחסים ל-ChatGPT רק כמנוע חיפוש או ככלי עבודה, אלא משתפים אותו בפרטים אישיים מאוד. בין היתר עשויות להופיע בשיחות התייעצויות רפואיות ונפשיות, מידע פיננסי, מסמכים, קודי תוכנה, סודות מסחריים ופרטים נוספים שהמשתמשים בחרו להכניס לשיחה.

לפי המסמכים הפנימיים שנחשפו בתחקיר, קיים דשבורד ייעודי שבאמצעותו הסוקרים יכולים לבחור שיחות אמיתיות ולבחון אותן. אף שפרטים מסוימים אמורים להיות מוסתרים לפני שהשיחה מגיעה לבדיקה, התחקיר מצא כי הפרומפטים עצמם עלולים להכיל פרטים שמאפשרים לזהות את המשתמש או להבין פרטים נוספים עליו.

בין היתר, שיחות עשויות לכלול מיקום גיאוגרפי, מידע שנשמר בזיכרון של הצ’אט ופרטים אישיים שהמשתמש עצמו הזין. במקרים מסוימים, משתמשים אף ביקשו במפורש מ-ChatGPT לשמור מידע מסוים בסוד, מבלי לדעת שהשיחה עשויה להגיע בהמשך לבדיקה אנושית במסגרת תהליך הערכת המודל.

המטרה של הבדיקה אינה סתם לקרוא את השיחות. הסוקרים נדרשים להעריך את איכות תגובות המודל ולסייע ל-OpenAI לשפר את התנהגותו. לפי התחקיר, הם מתבקשים לתמצת את מטרת המשתמש, לבחון כמה תגובות אפשריות של המערכת ולדרג אותן בסולם של 1 עד 7.

ההנחיות שקיבלו הסוקרים כוללות גם התייחסות לאופן שבו ChatGPT אמור להתנהל מול המשתמשים. בין היתר נבחנת הנטייה של המודל להיות חנפן מדי או לאשר באופן בלתי ביקורתי את דברי המשתמש. הסוקרים מתבקשים גם להפחית ניקוד במקרים שבהם המודל עושה שימוש מוגזם באימוג’ים או מציג את עצמו כאילו הוא בעל חוויות ורגשות אנושיים.

ב-OpenAI לא הכחישו את עצם העובדה שבני אדם בוחנים שיחות, אך הסבירו כי קיים מנגנון סינון שנועד לצמצם את החשיפה למידע אישי. המערכת, המכונה Privacy Filter, אמורה לזהות ולהסיר פרטים מזהים כמו שמות ומספרי זיהוי לפני שהמידע מגיע למאגרי האימון או לתהליכי בדיקה מסוימים.

אלא שהסינון אינו מושלם. לפי המידע שפורסם ולפי ההסברים של OpenAI, מנגנוני הסינון עשויים לפספס פרטים מזהים חריגים או מידע שניתן לזהות באמצעות שילוב של כמה פרטים שונים. המשמעות היא שגם כאשר המערכת מנסה להסיר מידע מזהה, לא ניתן להבטיח שכל פרט אישי ייעלם לחלוטין מהחומר שנבדק.

התופעה אינה ייחודית ל-OpenAI. התחקיר מציין כי בדיקה אנושית של שיחות היא פרקטיקה מוכרת בתעשיית הבינה המלאכותית. חברת Anthropic אישרה כי גם היא משתמשת בסוקרים אנושיים לצורך בדיקת שיחות במודל Claude, וגם Google מציינת שימוש בבדיקה אנושית במסגרת הפעלת Gemini.

לפי התחקיר, עובדים למשימות מסוג זה מגויסים בין היתר באמצעות חברות כוח אדם ופלטפורמות המתווכות בין חברות טכנולוגיה לבין עובדים וקבלנים. אחת הפלטפורמות שהוזכרו היא Mercor, שעלתה בעבר לכותרות בעקבות דליפת מידע והשלכות שהיו לכך על התקשרויות עם חברות טכנולוגיה.

עבור משתמשי ChatGPT, הנקודה המרכזית היא האפשרות לשלוט בשימוש בתוכן השיחות לצורך שיפור המודלים. OpenAI מציינת באופן רשמי כי בשירותים המיועדים למשתמשים פרטיים, ובהם ChatGPT, החברה עשויה להשתמש בתוכן לצורך אימון ושיפור המודלים, אלא אם המשתמש בוחר שלא לאפשר זאת.

כדי לבטל את האפשרות הזו, ניתן להיכנס ל-Settings, לבחור Data Controls ולכבות את האפשרות “Improve the model for everyone”. לפי OpenAI, לאחר כיבוי ההגדרה, שיחות חדשות לא ישמשו לאימון המודלים, בעוד שהן עדיין יכולות להישאר בהיסטוריית השיחות של המשתמש. ההגדרה חלה על החשבון כולו ואינה מוגבלת למכשיר מסוים.

עם זאת, קיימת הסתייגות חשובה: גם משתמש שבחר שלא לאפשר שימוש בשיחותיו לאימון יכול לשלוח משוב על תשובה באמצעות סימוני לייק או דיסלייק. OpenAI מציינת כי במקרה כזה, השיחה הקשורה למשוב עשויה לשמש לאימון המודלים.

אפשרות נוספת היא להשתמש ב-Temporary Chat. לפי OpenAI, שיחות זמניות אינן מופיעות בהיסטוריית הצ’אטים, אינן יוצרות זיכרונות ואינן משמשות לאימון המודלים. החברה מציינת כי שיחות כאלה עשויות להישמר למשך תקופה מוגבלת לצורכי בטיחות.

החשיפה מחדדת את אחת הסוגיות המרכזיות בעידן הבינה המלאכותית: הפער בין האופן שבו המשתמשים תופסים שיחה עם מערכת AI לבין האופן שבו המידע עשוי לעבור עיבוד מאחורי הקלעים. עבור המשתמש, מדובר לעיתים בשיחה פרטית עם כלי דיגיטלי. מאחורי המערכת, לעומת זאת, קיימים תהליכי בקרה, הערכה ואימון שבהם עשויים להיות מעורבים גם בני אדם.

לכן, גם כאשר מדובר בשיחה עם מערכת בינה מלאכותית ולא עם אדם, מומלץ להביא בחשבון את אופן השימוש במידע ולבדוק את הגדרות הפרטיות לפני שמכניסים לשיחה פרטים אישיים או מידע רגיש.

OpenAI אנתרופיק (Anthropic) גוגל (Google) ChatGPT קלוד (Claude) ג'מיני (‏Gemini)
להצטרפות לקבוצת הווטסאפ של 'בחדרי חרדים'
לחץ כאן

הוספת תגובה

לכתבה זו טרם התפרסמו תגובות

תגובות

הוסיפו תגובה
{{ comment.number }}.
{{ comment.date_parsed }}
הגב לתגובה זו
{{ reply.date_parsed }}