Современные социальные сети превратились в один из крупнейших источников данных для обучения генеративного искусственного интеллекта. Посты, фотографии, комментарии, переписки и даже взаимодействия с ботами по умолчанию попадают в обучающие выборки крупных технологических компаний, а возможность полноценно отказаться от такой обработки доступна далеко не всем пользователям и не во всех регионах. Редакция XAB.info со ссылкой на материал РБК-Украина и Lifehacker разобралась, какие именно данные используются, где в настройках можно отключить их передачу и почему, по мнению аналитиков, наиболее надёжной защитой по-прежнему остаются приватные аккаунты или их полное удаление.
Как соцсети используют ваши данные для обучения ИИ
Компания Meta привлекает к обучению собственных моделей сообщения, фотографии, комментарии и другие формы взаимодействия пользователей. Платформа профессионального нетворкинга LinkedIn по умолчанию использует сообщения, комментарии, данные профилей и резюме. Родительская компания TikTok — ByteDance — также задействует публикуемый контент для тренировки алгоритмов. Google, в свою очередь, использует загруженные на YouTube видео для обучения моделей генерации видео. Таким образом, практически каждый крупный сервис в той или иной степени строит свои ИИ-модели на пользовательском контенте, даже если пользователь об этом не задумывается.
Где можно отключить обучение ИИ на ваших данных
У большинства платформ существует отдельный переключатель в настройках конфиденциальности. В LinkedIn путь выглядит так: «Настройки и конфиденциальность» → «Конфиденциальность данных» → «Данные для улучшения генеративного ИИ», где нужно отключить соответствующий тумблер. В X отключить передачу данных можно через «Настройки» → «Конфиденциальность и безопасность» → «Обмен данными и персонализация» → «Grok и сторонние партнеры». На YouTube авторам контента в «Творческой студии» доступен раздел «Настройки» → «Канал» → «Расширенные настройки», однако он позволяет запретить лишь обучение моделей сторонних компаний. Для TikTok механизм отказа иной: необходимо заполнить специальную форму возражения из-за нарушения конфиденциальности на странице поддержки.
Противоречивые данные
Здесь есть существенные нестыковки между официальными заявлениями платформ и фактическим потоком данных. Так, X официально заявляет, что не тренирует собственные модели на постах пользователей, однако из-за открытости децентрализованного протокола любые публичные данные могут парситься сторонними разработчиками, а публичные сообщения и взаимодействия с ботом Grok фактически используются для обучения моделей xAI. Получается, что формальный отказ платформы от обучения не тождественен защите данных пользователя. Аналогичная оговорка касается Meta: опция полного отказа от использования данных для ИИ действует преимущественно для жителей ЕС из-за требований европейского законодательства, тогда как пользователям из других регионов доступна лишь подача жалобы в случае обнаружения своих персональных данных в ответах нейросети. То есть «красная кнопка» отказа существует не для всех и не везде.
Что рекомендуют аналитики
Эксперты подчёркивают, что из-за дефолтной модели «собираем по умолчанию» настройка отдельных переключателей не даёт полной гарантии. Самыми надёжными способами защиты контента аналитики называют перевод аккаунтов в частный режим или их полное удаление, поскольку большинство сервисов собирают данные автоматически. Для пользователей, которым принципиально важна конфиденциальность, это означает, что вопрос защиты от ИИ-обучения решается не одной настройкой, а комплексом решений: от ограничения публичности до контроля над тем, какие именно сервисы получают доступ к контенту.