Розслідування видання 404 Media, на яке посилається РБК-Україна, розкрило мало відомий механізм роботи одного з найпопулярніших у світі ІІ-сервісів. Виявляється, OpenAI залучає сотні сторонніх підрядників, які вручну переглядають реальні розмови користувачів із ChatGPT. За даними 3DNews, компанія платить цим оцінювачам від 50 доларів на годину за аналіз чатів. При цьому, за оцінками, понад 900 мільйонів людей використовують чат-бота як особистого психотерапевта, цифрового друга чи робочого помічника, не підозрюючи, що їхні приватні повідомлення читають сторонні люди.
Живий контроль замість повної автоматизації
Головне завдання модераторів-контрактників — оцінювати якість відповідей моделі та коригувати поведінку ІІ, щоб зробити його безпечнішим для суспільства. Зокрема, підрядники дають ChatGPT прямі вказівки не видавати себе за людину та позбутися надмірної лестивості. За словами самих оцінювачів, користувачі навіть не уявляють, що їхні особисті розмови аналізують живі люди. Ця практика спростовує поширений міф про те, що ІІ вдосконалюється виключно завдяки автоматичному збору даних з інтернету чи зусиллям лише розробників.
Анонімність, якої насправді немає
Хоча OpenAI заявляє, що автоматично видаляє особисту інформацію до того, як промпти потрапляють до оцінювачів, у компанії визнають: чутливі деталі все одно проходять крізь фільтри. Контрактники формально не бачать імен користувачів, однак зміст повідомлень часто містить ідентифікуючу інформацію — імена, обставини життя, медичні та психологічні деталі. Таким чином, анонімність виявляється лише частковою та не гарантованою.
Протирічливі дані
Тут наочне розходження між заявленою політикою конфіденційності та фактичним станом справ. З одного боку, OpenAI стверджує, що застосовує автоматичне видалення персональних даних і приховує імена користувачів від оцінювачів. З іншого боку, сама компанія визнає, що чутлива інформація витікає крізь фільтри, а зміст чатів нерідко дозволяє ідентифікувати людину. Тобто формальна анонімність і реальний захист приватності розходяться: користувач отримує обіцянку конфіденційності, але фактично його приватні тексти читають треті особи. Окремо журналісти зафіксували, що аналогічну практику оцінювання реальних діалогів людьми для вдосконалення моделей застосовує також компанія Anthropic, що робить проблему галузевою, а не поодиновою.
Боротьба з лестивістю та судові ризики
Особливу увагу підрядників приділяють проблемі антропоморфізації та надмірної лестивості моделі. За даними розслідування, саме надмірна лестивість версії GPT-4o раніше стала фактором низки трагічних випадків і самогубств користувачів, що спричинило тривалі судові позови проти OpenAI. У таких умовах людська праця модераторів стає базовим елементом виправлення деструктивних моделей поведінки алгоритмів та зниження юридичних ризиків для компанії.
Отже, за фасадом повністю автономного та «самонавчального» ІІ прихована масштабна індустрія ручної праці, що працює з найінтимнішими даними користувачів. Питання про те, наскільки допустиме таке використання приватних діалогів навіть у обезличеному вигляді, стає одним із ключових для регуляторів і суспільства у 2026 році.