В августе 2026 года технологический ландшафт глобального рынка искусственного интеллекта претерпевает фундаментальные изменения. Китайский гигант ByteDance, всемирно известный как создатель социальной сети TikTok, официально подтверждает масштабные амбиции в сфере создания больших языковых моделей (LLM). По данным авторитетных источников, включая Financial Times, компания находится на завершающей стадии предварительного обучения собственной ИИ-модели колоссального масштаба — с 10 триллионами параметров.

Технологическая гонка: 10 трлн против 8 трлн

Разработка модели с 10 трлн параметров ставит ByteDance в один ряд с передовыми мировыми игроками, такими как американский стартап Anthropic. Для сравнения, флагманская модель Anthropic, Mythos 5, оценивается экспертами в 8 трлн параметров, а её более компактная версия Fable 5 — в 5 трлн. Китайская модель, таким образом, не просто догоняет, но и претендует на лидерство по объему параметров, что теоретически позволяет ей обрабатывать и хранить в памяти беспрецедентные объемы данных.

Однако эксперты подчеркивают, что количество параметров — не единственный и не всегда определяющий фактор успеха. Качество входных данных, архитектура модели и методы обучения играют критическую роль. В отличие от многих конкурентов, прибегающих к дистилляции (упрощению) чужих разработок, ByteDance делает ставку на собственные ресурсы и уникальные наработки, стремясь создать модель, превосходящую западные аналоги по качеству генерации и логическому мышлению.

Стратегия «Долгосрочного доминирования»

Основатель ByteDance Чжан Иминь (Zhang Yiming) сформулировал четкую стратегию для своей команды: краткосрочное отставание не имеет значения в свете долгосрочных целей. В штате компании над созданием ИИ-модели трудится команда из 2000 специалистов, включая инженеров, исследователей, специалистов по маркировке данных и переводчиков. Работа ведется как в Китае, так и в международных офисах, что позволяет компании использовать глобальные таланты и данные.

Сейчас модель находится на этапе предварительного обучения (pre-training), который, по оценкам инсайдеров, занимает от трех до шести месяцев. После этого последует этап тонкой настройки (fine-tuning), необходимый для адаптации модели к конкретным задачам и безопасности. Только после завершения всех этапов модель будет выпущена в коммерческий оборот, что, вероятно, произойдет в конце 2026 или начале 2027 года.

Противоречивые данные

В индустрии ИИ существуют разногласия относительно того, насколько показатель количества параметров коррелирует с реальными возможностями модели. С одной стороны, сторонники масштабирования (scaling laws) утверждают, что увеличение параметров до 10 трлн неизбежно приведет к появлению новых, ранее недоступных способностей (эмерджентных свойств). С другой стороны, критики указывают на пример китайской модели Kimi 3 от компании Moonshot, которая с чуть менее чем 3 трлн параметров уже демонстрирует выдающиеся результаты, считаясь одной из самых эффективных в КНР.

Кроме того, точные данные о параметрах моделей Anthropic (Mythos 5 и Fable 5) являются оценочными, так как компания не раскрывает эту информацию официально. Это создает определенную неопределенность в сравнении: ByteDance может опережать конкурентов по «бумажным» характеристикам, но реальное превосходство станет ясно только после публичных бенчмарков и тестов.

Глобальные последствия и конкуренция

Выход модели ByteDance на рынок может кардинально изменить баланс сил в гонке ИИ. Учитывая интеграцию с экосистемой TikTok, новая модель получит мгновенный доступ к огромному количеству пользовательских данных и сценариев использования, что ускорит её обучение и адаптацию. Это создает прямую угрозу для OpenAI и Google, которые до сих пор доминировали в сегменте сверхмощных моделей.

Кроме того, успех ByteDance может стать катализатором для других китайских технологических компаний, которые также активно инвестируют в ИИ. Ожидается, что в ближайшие месяцы мы увидим всплеск анонсов новых моделей из КНР, что приведет к еще более жесткой конкуренции на глобальном рынке.