---
title: "Nvidia: оболонка, а не модель, робить ШІ агентом — Claude Opus 5 взяла 100% в ARC-AGI-3"
description: "Дослідження Nvidia показало, що програмна оболонка з супервізором дозволила Claude Opus 5 набрати 100% в ARC-AGI-3 проти 30% без неї, змістивши фокус з базової моделі на агентну систему."
date: 2026-08-23T17:26:49.000Z
lang: uk
url: https://xab.info/uk/posts/nvidia-claude-opus-5-obolonka-100-arc-agi-3-uk
tags: [nvidia, claude-opus-5, ai-agents, arc-agi-3, openai]
publisher: "XAB.info"
---

# Nvidia: оболонка, а не модель, робить ШІ агентом — Claude Opus 5 взяла 100% в ARC-AGI-3

![Стилізована голова з друкованої плати — метафора ІІ-агента Nvidia та Claude Opus 5, що взяла 100% в ARC-AGI-3](https://xab.info/media/2026/08/24/nvidia-claude-opus-5-obolochka-100-arc-agi-3/nvidia-claude-opus-5-obolochka-100-arc-agi-3-1.webp)

## 🎯 Key Points

- За даними Nvidia, програмна оболонка важливіша за базову модель для довгострокових ШІ-задач.
- З оболонкою та супервізором Claude Opus 5 набрала 100% в ARC-AGI-3, без оболонки — 30% (найкращий результат серед протестованих).
- Моделі OpenAI в ARC-AGI-3 набрали менше 10%; OpenAI стверджує, що заміна двох параметрів середовища потроїла показники.
- Nvidia описує агента як модель плюс інструменти, середовище виконання, навички та бібліотеки, а супервізора — як «генерального директора».

Дослідження Nvidia, результати якого компанія передала виданню TechCrunch, зміщує центр ваги в розробці ШІ-агентів: за висновками інженерів, саме програмна оболонка, а не базова мовна модель, визначає успіх при розв'язанні задач із тривалим горизонтом планування. Ключовою демонстрацією стала робота з моделлю Claude Opus 5 на бенчмарку ARC-AGI-3 — наборі 2D-ігор без інструкцій, де система має самостійно зрозуміти правила і навчитися перемогувати, подібно до людини.

### Оболонка вирішує: як Claude Opus 5 взяла 100% в ARC-AGI-3

Завдяки спеціальній програмній оболонці для ефективного управління пам'яттю, доповненій компонентом, схожим на «супервізора», дослідники досягли того, що Claude Opus 5 набрала 100% балів у інтерактивному тесті ARC-AGI-3. Без цієї оболонки та сама модель показала лише 30% — і це, за даними Nvidia, стало найкращим результатом серед усіх протестованих моделей. Таким чином, розрив між «голою» моделлю та моделлю в агентній інфраструктурі виявився кратно більшим.

### «Агент — це не API моделі»: позиція Nvidia

«Загалом світ сприймає агента майже як API моделі», — повідомив ресурсу TechCrunch Адель Ель Халлак (Adel El Hallak), віце-президент із продуктів підрозділу ШІ Nvidia. За його словами, агент сьогодні — це щось більше: «Це модель. Це структура навколо моделі, яку ми називаємо допоміжними засобами, тобто набір інструментів, які ви використовуєте. Це середовище виконання, а також пов'язані з ним навички та бібліотеки, до яких ми надаємо вам доступ». Вибір моделі, як підкреслює Nvidia, недостатній — саме система управління, що обробляє пам'ять, контекст і зворотний зв'язок, перетворює модель на агента.

### Супервізор як «генеральний директор» ШІ

Окремий акцент у дослідженні зроблено на введенні супервізорного агента доповнення до основного агента, що виконує роботу. За словами Ель Халлака, він «діє майже як генеральний директор, підштовхуючи агента, коли той відхиляється від курсу або починає досліджувати шлях, який може привести в глухий кут, або повторно досліджує шлях, яким він уже йшов». Саме така дворівнева структура, на думку Nvidia, дозволяє утримувати фокус на довгостроковій задачі без закручування в коло та втрати контексту.

### Суперечливі дані

Тут доречно зіставити дві точки зору. З одного боку, Nvidia демонструє, що саме складна агентна оболонка з супервізором вивела Claude Opus 5 на 100% в ARC-AGI-3, а без неї результат впав до 30%, при цьому моделі OpenAI в тому ж тесті набрали менше 10%. З іншого боку, OpenAI минулого місяця провела власне дослідження і виявила, що проста заміна двох параметрів у тестовому середовищі потроїла показники моделей. Це ставить питання про те, наскільки саме архітектура оболонки, а не тонка налаштування середовища та параметрів, є визначальним фактором: інтерпретація Nvidia підкреслює роль інфраструктури агента, тоді як дані OpenAI вказують на високу чутливість результату до умов тестового середовища. Обидві сторони згодні в тому, що «гола» модель — лише частина системи, але розходяться в оцінці внеску оболонки versus параметрів середовища.

### Що це означає для довгострокових ШІ-задач

Результати підтверджують: хоча вибір моделі має значення, вона є значно меншою частиною агентної системи, ніж прийнято вважати, особливо для довгострокових задач. Визначення того, як змусити ШІ виконувати задачі з тривалим горизонтом планування, не відволікаючись і не закручуючись в одному місці, залишається однією з головних цілей досліджень у галузі ШІ-агентів. Практичний висновок для розробників — інвестиції в пам'ять, контекст, інструменти та супервізорну логіку можуть давати більший приріст, ніж заміна базової моделі.

## 🔍 Fact-Check Verification

- [Claude покращив результати втричі завдяки оболонці: Nvidia показала новий шлях розвитку ШІ-агентів window-new](https://3dnews.ru/1147286/claude-uluchshil-rezultati-v-tri-raza-blagodarya-obolochke-nvidia-pokazala-noviy-put-razvitiya-iiagentov) - Источник содержит все ключевые факты: 100% Claude Opus 5 в ARC-AGI-3 с оболочкой, 30% без неё, цитату Аделя Эль Халлака для TechCrunch и данные OpenAI (<10% и утроение после замены двух параметров). Цифры не перепроверены независимым вторым источником в предоставленном наборе.
- [«Вибачте, це друкарська помилка»: Claude Opus 5 видалив усі дані користувача замість створення резервної копії](https://3dnews.ru/1146456/izvinite-opechatka-claude-opus-5-udalil-vse-dannie-polzovatelya-vmesto-sozdaniya-rezervnoy-kopii) - Источник содержит все ключевые факты: 100% Claude Opus 5 в ARC-AGI-3 с оболочкой, 30% без неё, цитату Аделя Эль Халлака для TechCrunch и данные OpenAI (<10% и утроение после замены двух параметров). Цифры не перепроверены независимым вторым источником в предоставленном наборе.

## ❓ FAQ

### Q: Що показало дослідження Nvidia щодо ARC-AGI-3?
**A:** З програмною оболонкою для управління пам'яттю та компонентом-супервізором Claude Opus 5 набрала 100% у тесті ARC-AGI-3, тоді як без оболонки та сама модель показала 30% — найкращий результат серед усіх протестованих моделей.

### Q: Чому Nvidia вважає оболонку важливішою за модель?
**A:** За словами віце-президента зі продуктів ШІ Nvidia Аделя Ель Халлака, агент — це не просто API моделі, а модель плюс допоміжні інструменти, середовище виконання, навички та бібліотеки. Саме ця система управління пам'яттю, контекстом і зворотним зв'язком робить модель агентом, особливо в довгострокових задачах.

### Q: Що показують моделі OpenAI в тому ж тесті?
**A:** Моделі OpenAI в ARC-AGI-3 набрали менше 10%. При цьому OpenAI минулого місяця виявила, що проста заміна двох параметрів у тестовому середовищі потроїла їхні показники, що вказує на високу чутливість результату до умов середовища.