У серпні 2026 року технологічний ландшафт глобального ринку штучного інтелекту зазнає фундаментальних змін. Китайський гігант ByteDance, всесвітньо відомий як творець соціальної мережі TikTok, офіційно підтверджує масштабні амбіції у сфері створення великих мовних моделей (LLM). За даними авторитетних джерел, включаючи Financial Times, компанія перебуває на завершальній стадії попереднього навчання власної ШІ-моделі колосального масштабу — з 10 трильйонами параметрів.
Технологічна гонка: 10 трлн проти 8 трлн
Розробка моделі з 10 трлн параметрів ставить ByteDance в один ряд із провідними світовими гравцями, такими як американський стартап Anthropic. Для порівняння, флагманська модель Anthropic, Mythos 5, оцінюється експертами в 8 трлн параметрів, а її більш компактна версія Fable 5 — у 5 трлн. Китайська модель, таким чином, не просто наздоганяє, але й претендує на лідерство за обсягом параметрів, що теоретично дозволяє їй обробляти та зберігати в пам'яті безпрецедентні обсяги даних.
Однак експерти підкреслюють, що кількість параметрів — не єдиний і не завжди визначальний фактор успіху. Якість вхідних даних, архітектура моделі та методи навчання відіграють критичну роль. На відміну від багатьох конкурентів, які вдаються до дистиляції (спрощення) чужих розробок, ByteDance робить ставку на власні ресурси та унікальні напрацювання, прагнучи створити модель, що перевершує західні аналоги за якістю генерації та логічним мисленням.
Стратегія «Довгострокового домінування»
Засновник ByteDance Чжан Імін (Zhang Yiming) сформулював чітку стратегію для своєї команди: короткострокове відставання не має значення в світлі довгострокових цілей. У штаті компанії над створенням ШІ-моделі працює команда з 2000 фахівців, включаючи інженерів, дослідників, спеціалістів з маркування даних та перекладачів. Робота ведеться як у Китаї, так і в міжнародних офісах, що дозволяє компанії використовувати глобальні таланти та дані.
Зараз модель перебуває на етапі попереднього навчання (pre-training), який, за оцінками інсайдерів, триватиме від трьох до шести місяців. Після цього настане етап донавчання (fine-tuning), необхідний для адаптації моделі до конкретних завдань та безпеки. Тільки після завершення всіх етапів модель буде випущена в комерційний обіг, що, ймовірно, станеться наприкінці 2026 або на початку 2027 року.
Суперечливі дані
У індустрії ШІ існують розбіжності щодо того, наскільки показник кількості параметрів корелює з реальними можливостями моделі. З одного боку, прихильники законів масштабування (scaling laws) стверджують, що збільшення параметрів до 10 трлн неминуче призведе до появи нових, раніше недоступних здібностей (емерджентних властивостей). З іншого боку, критики вказують на приклад китайської моделі Kimi 3 від компанії Moonshot, яка з трохи менше ніж 3 трлн параметрів вже демонструє видатні результати, вважаючись однією з найефективніших у КНР.
Крім того, точні дані про параметри моделей Anthropic (Mythos 5 та Fable 5) є оціночними, оскільки компанія не розкриває цю інформацію офіційно. Це створює певну невизначеність у порівнянні: ByteDance може випереджати конкурентів за «паперовими» характеристиками, але реальне переважання стане зрозумілим лише після публічних бенчмарків та тестів.
Глобальні наслідки та конкуренція
Вихід моделі ByteDance на ринок може кардинально змінити баланс сил у гонці ШІ. Враховуючи інтеграцію з екосистемою TikTok, нова модель отримає миттєвий доступ до величезної кількості користувацьких даних та сценаріїв використання, що прискорить її навчання та адаптацію. Це створює пряму загрозу для OpenAI та Google, які досі домінували в сегменті надпотужних моделей.
Крім того, успіх ByteDance може стати каталізатором для інших китайських технологічних компаній, які також активно інвестують у ШІ. Очікується, що в найближчі місяці ми побачимо сплеск анонсів нових моделей з КНР, що призведе до ще більш жорсткої конкуренції на глобальному ринку.