Китайський технологічний сектор зробив потужний ривок на глобальному ринку штучного інтелекту. У понеділок компанія Alibaba представила свою найбільшу та найпотужнішу на сьогодні модель, що негайно відобразилося на фінансових показниках: акції корпорації стрімко зросли на 7% під час торгів у Гонконзі. Паралельно з цим конкурент, компанія DeepSeek, запустила модель, яка пропонує послуги більш ніж у 100 разів дешевше, ніж флагманський продукт американської компанії Anthropic.
Новий гігант від Alibaba: Qwen3.8-Max
Нова модель Qwen3.8-Max одразу посіла високі позиції у міжнародних рейтингах. Вона підтримує 2,4 трильйона параметрів — числових налаштувань, які система використовує для розпізнавання закономірностей та генерації відповідей. За цим показником вона лише трохи поступається моделі Kimi K3 від Moonshot AI, випущеній місяцем раніше (2,8 трильйона параметрів). Експерти зазначають, що кількість параметрів сама по собі не гарантує переваги, але слугує важливим індикатором масштабу обчислювальних ресурсів та даних, закладених у систему.
На краудсорсинговій платформі Arena.AI, де порівнюються можливості нейромереж, Qwen3.8-Max стала одним із лідерів серед китайських текстових моделей. У категорії аналізу зображень та візуальних матеріалів вона посіла друге місце у світі, поступившись лише моделі Claude Fable 5 від Anthropic.
Технологічна ефективність та швидкість
Ключовою перевагою Qwen3.8-Max є її здатність працювати з величезними обсягами даних. Модель може обробляти до 1 мільйона токенів (фрагментів даних) за один раз. Це дозволяє їй аналізувати довгі юридичні документи, обширні бази програмного коду або сотні сторінок тексту одночасно.
Для досягнення високої продуктивності Alibaba використала архітектуру «змішаних експертів». Вона розподіляє завдання між спеціалізованими частинами системи, залучаючи одночасно лише 95 мільярдів параметрів. Такий підхід знижує витрати та затримки відповіді. Як доказ ефективності компанія навела приклад: Qwen3.8-Max завершила проект з розробки програмного забезпечення всього за 16 днів.
Битва за доступність: DeepSeek проти гігантів
Тоді як Alibaba робить ставку на потужність, DeepSeek атакує ринок ціною. Їхня модель V4-Flash, випущена у п'ятницю, за даними дослідницької компанії Artificial Analysis, є найдешевшою серед відомих у світі. Вартість використання V4-Flash становить $0,14 за мільйон вхідних токенів та $0,28 за мільйон вихідних.
Для порівняння, середня вартість тесту для V4-Flash оцінюється у $0,03. Тим часом конкуренти пропонують послуги за значно вищими тарифами:
- Kimi K3 — $0,86;
- GPT-5.6 Sol від OpenAI — $1,86;
- Claude Fable 5 — $3,15.
Стратегія відкритих моделей
Обидві китайські новинки демонструють прихильність політиці відкритих моделей. На відміну від OpenAI, Anthropic та Google, які використовують закритий вихідний код, китайські компанії надають розробникам доступ до базових параметрів навчання. Це дозволяє спеціалістам у всьому світі запускати або адаптувати системи під свої потреби.
Головний аналітик дослідницької фірми Omdia Лянь Цзе Су (Lian Jye Su) зазначає, що китайські розробники знайшли свою нішу: «Для багатьох бізнес-процесів не потрібна найкраща в галузі модель. Їм потрібні рішення, які досить хороші, доступні за ціною, прозорі та зручні у використанні».