Американська компанія OpenAI зробила значний крок у еволюції штучного інтелекту, представивши нове покоління великих мовних моделей — сімейство GPT-5.6. Цей реліз означає не просто оновлення версій, а фундаментальний перегляд архітектури та підходів до класифікації нейромереж. Вперше замість звичних маркетингових суфіксів, таких як Mini чи Pro, розробники впровадили систему постійних категоріальних класів, що відображають обчислювальну потужність та призначення моделей.
Нова лінійка складається з трьох рівнів: флагманський Sol, збалансований Terra та бюджетний Luna. Однак за технологічним проривом ховається й жорстка регуляторна реальність: на поточному етапі доступ до цих інструментів суворо обмежений урядом США.
Технічна архітектура та економічна модель
Сімейство GPT-5.6 створено для вирішення завдань високої складності у сферах автономного програмування, системного адміністрування та кібербезпеки. Кожна модель має фіксовану тарифікацію за мільйон токенів, що дозволяє бізнесу точно прогнозувати витрати при інтеграції через API або платформу Codex.
Ключові характеристики та вартість використання нових класів виглядають наступним чином:
- GPT-5.6 Sol (Флагман): Модель вищого класу, оптимізована для глибокого аналізу. Вартість використання становить $5 за 1 млн вхідних та $30 за 1 млн вихідних токенів.
- GPT-5.6 Terra (Баланс): Забезпечує продуктивність, що відповідає попередній версії GPT-5.5, але водночас знижує операційні витрати вдвічі. Тариф: $2,5 за вхід та $15 за вихід.
- GPT-5.6 Luna (Доступність): Високошвидкісна полегшена версія, призначена для рутинних автоматизованих сценаріїв. Найдоступніший варіант: $1 за вхід та $6 за вихід.
Результати бенчмарків: перемога в автономному плануванні
Під час профільного тестування на спеціалізованому бенчмарку TerminalBench 2.1, що оцінює здатність ШІ до автономного планування та управління в середовищах командного рядка, флагманська модифікація Sol продемонструвала видатні результати.
При використанні стандартного алгоритму міркувань модель набрала 88,8%. Однак при активації розширеного режиму Sol Ultra результат зріс до 91,9%. Для порівняння, показник конкуруючого рішення Claude Mythos 5 від компанії Anthropic у аналогічному тесті становив 88%. Це підтверджує лідерство OpenAI у завданнях, що вимагають складної логічної ланцюжності та інженерного мислення.
Нові режими обробки даних
Технологічним нововведенням архітектури GPT-5.6 стало впровадження двох варіативних режимів виконання запитів, що змінюють підхід до генерації відповідей:
- Режим max: Розширює часовий ліміт (зусилля міркування) на приховані логічні ланцюжки, дозволяючи моделі будувати більш верифіковані та точні відповіді.
- Режим ultra: Виходить за межі ізольованої архітектури, розгортаючи ієрархічну мережу паралельно функціонуючих субагентів. Це дозволяє декомпозувати та вирішувати надскладні інженерні чи біологічні завдання.
Регуляторні обмеження та статус кібербезпеки
Попри технологічну готовність, масовий запуск моделей стримується регуляторною політикою Білого дому. Згідно з внутрішнім регламентом Preparedness Framework від OpenAI, версії Sol та Terra класифіковані як «високий ризик» (High) у категоріях потенційного застосування у сфері кібербезпеки та біологічних загроз.
Моделі демонструють виражені оборонні можливості, включаючи пошук вразливостей та генерацію патчів, що робить їх потужним інструментом, що потребує суворого контролю. У зв'язку з цим регуляторні органи США тимчасово обмежили коло користувачів приблизно двадцятьма акредитованими корпоративними партнерами. Остаточне формування нормативної бази очікується в рамках нового виконавчого указу (Executive Order).
У офіційній заяві OpenAI підкреслюється, що поточний закритий формат прев'ю-доступу не є постійним стандартом. Менеджмент компанії визнає, що тимчасові обмеження стримують комерційне використання передових захисних ІТ-інструментів глобальним пулом розробників, однак безпека залишається пріоритетом на етапі впровадження.