Компанія Microsoft, як і багато інших технологічних гігантів, залучає сотні сторонніх підрядників для ручного аналізу та оцінки текстових запитів і зображень, які користувачі надсилають у чат-бот Copilot. Як з'ясувалося під час журналістського розслідування, ця практика пов'язана із серйозними етичними проблемами: модератори та перевіряльники регулярно стикаються з конфіденційними кадрами та матеріалами відверто інтимного характеру. Подібні перевірки проводяться з метою покращення роботи сервісу та налаштування алгоритмів генеративного штучного інтелекту, проте користувачі часто навіть не підозрюють, що їхні особисті фотографії розглядаються живими людьми.
Особливості роботи модераторів та витік документів
У розпорядженні профільних видань опинився пакет внутрішніх документів компанії Prolific, через яку Microsoft наймає фахівців для оцінки якості генерації. В інструкції для підрядників чітко прописано, що їм доводиться оцінювати результати редагування знімків користувачів. Перед очима перевіряльників постають вихідний запит, оригінальне завантажене зображення та два варіанти, створені нейромережею. При цьому обличчя на фотографіях залишаються без цензури, а самі матеріали нерідко викликають шок у співробітників, оскільки не підлягають попередній жорсткій фільтрації на предмет етичності чи законності.
Інструкції для підрядників та реакція Microsoft
Згідно з внутрішніми регламентами, підрядники мають покладатися на власну інтуїцію під час вибору найуспішнішого варіанта генерації, не акцентуючи увагу на моральній стороні питання. Проте деякі оператори скаржилися на важкі умови праці та необхідність обробляти потенційно небезпечний чи незаконний контент, звертаючись до керівництва з проханням позначити такі завдання як проблемні. У відповідь на запити ЗМІ представники Microsoft заявили, що компанія обробляє дані користувачів суворо відповідно до чинних умов використання, включаючи цілі покращення продуктових характеристик та дотримання внутрішніх кодексів етики.
Суперечливі дані
У той час як офіційна позиція Microsoft підкреслює законність і безпеку використання клієнтських даних для вдосконалення штучного інтелекту, незалежні спостерігачі та самі підрядники вказують на глибокі вразливості у захисті конфіденційності. Корпорація стверджує, що всі процеси автоматизовані та контролюються, проте витік внутрішніх інструкцій доводить зворотне: живі люди отримують прямий доступ до нецензурованих інтимних матеріалів користувачів без їхньої явної та усвідомленої згоди на такий вид ручної модерації.