Компания Microsoft, как и многие другие технологические гиганты, привлекает сотни сторонних подрядчиков для ручного анализа и оценки текстовых запросов и изображений, отправляемых пользователями в чат-бот Copilot. Как выяснилось в ходе журналистского расследования, эта практика сопряжена с серьезными этическими проблемами: модераторы и проверяющие регулярно сталкиваются с конфиденциальными кадрами и материалами откровенно интимного характера. Подобные проверки проводятся с целью улучшения работы сервиса и настройки алгоритмов генеративного искусственного интеллекта, однако пользователи зачастую даже не подозревают, что их личные фотографии рассматриваются живыми людьми.
Особенности работы модераторов и утечка документов
В распоряжении профильных изданий оказался пакет внутренних документов компании Prolific, через которую Microsoft нанимает специалистов для оценки качества генерации. В инструкции для подрядчиков четко прописано, что им приходится оценивать результаты редактирования пользовательских снимков. Перед глазами проверяющих предстают исходный запрос, оригинальное загруженное изображение и два варианта, созданных нейросетью. При этом лица на фотографиях остаются без цензуры, а сами материалы нередко вызывают шок у сотрудников, поскольку не подлежат предварительной жесткой фильтрации на предмет этичности или законности.
Инструкции для подрядчиков и реакция Microsoft
Согласно внутренним регламентам, подрядчики должны полагаться на собственную интуицию при выборе наиболее удачного варианта генерации, не акцентируя внимание на моральной стороне вопроса. Тем не менее, некоторые операторы жаловались на тяжелые условия труда и необходимость обрабатывать потенциально небезопасный или незаконный контент, обращаясь к руководству с просьбой пометить такие задачи как проблемные. В ответ на запросы СМИ представители Microsoft заявили, что компания обрабатывает данные пользователей строго в соответствии с действующими условиями использования, включая цели улучшения продуктовых характеристик и соблюдение внутренних кодексов этики.
Противоречивые данные
В то время как официальная позиция Microsoft подчеркивает законность и безопасность использования клиентских данных для совершенствования искусственного интеллекта, независимые наблюдатели и сами подрядчики указывают на глубокие уязвимости в защите конфиденциальности. Корпорация утверждает, что все процессы автоматизированы и контролируются, однако утечка внутренних инструкций доказывает обратное: живые люди получают прямой доступ к нецензурированным интимным материалам пользователей без их явного и осознанного согласия на такой вид ручной модерации.