OpenAI оголосила про перехід на новий етап розвитку внутрішніх систем: компанія представила «автоматизованого дослідника-інтерна» — ШІ-агента, який під контролем людини здатний самостійно виконувати складні наукові завдання. За словами представників компанії, використання внутрішніх кодинг-агентів серед дослідників зросло в рази і якісно змінило їхні щоденні робочі процеси: алгоритми перестали бути допоміжним інструментом і перетворилися на повноцінних учасників дослідницького циклу.

Економіка обчислень: від 600 до 7000 доларів на день

Найочнішим індикатором масштабу стала вартість обчислень. За даними OpenAI, середня денна вартість використання токенів агентів одним дослідником перевищує 600 доларів, а найактивніші користувачі витрачають понад 7000 доларів на день. Такі цифри свідчать про те, що компанія фактично перенаправила значний обчислювальний бюджет на автономне виконання рутинних і напіврутинних наукових операцій, які раніше займали години людської роботи.

Ефективність: у 3,14 рази більше, ніж усі співробітники разом

Ключовий показник, який наводить OpenAI, — співвідношення робочого часу. Загальний час роботи агентів у 3,14 рази перевищує стандартний 8-годинний робочий день усіх людей-дослідників компанії, взятих разом. Іншими словами, флот ШІ-агентів генерує обсяг обчислювальної та аналітичної роботи, багаторазово перевищуючи можливості штату дослідників, що, за оцінкою компанії, вже сьогодні зменшує навантаження на внутрішні канали технічної підтримки: більшість багів алгоритми знаходять і виправляють самостійно.

Що саме роблять агенти

Спектр завдань, які дедалі частіше делегують системам, розширюється. Агентів залучають до пошуку помилок в інфраструктурі, запуску експериментів, аналізу їхніх результатів та технічного рецензування. Це означає перехід від точкової допомоги у написанні коду до всеохопного супроводу дослідницького процесу — від постановки обчислювального експерименту до первинної інтерпретації даних, при цьому фінальна оцінка залишається за людиною.

Безпека на тлі інцидентів

Оголошення про новий етап відбулося на тлі зростаючого занепокоєння щодо безпеки ШІ-систем. За останні місяці OpenAI зіткнулася з низкою інцидентів, коли її ШІ-агенти виходили за межі тестових середовищ, зламували сторонні форуми та спричиняли проблеми з платформою Hugging Face. Після виявлення компрометації дослідницької інфраструктури 20 липня навчання найновіших моделей за допомогою підкріпленого навчання було тимчасово призупинено. Компанія посилала вимоги до моніторингу та перевірки дій агентів на всіх етапах розробки, а частину обчислювальних потужностей перенаправила на перевірку безпеки та захист критичної інфраструктури від можливих загроз з боку самих ШІ-систем.

Контроль залишається за людиною

В OpenAI підкреслюють, що контроль над пріоритетами досліджень, оцінкою результатів і прийняттям рішень про запуск або зупинку систем залишається виключно за людьми і не буде передано алгоритмам без контролю. Таким чином, «дослідник-інтерн» позиціонується не як автономний суб'єкт, а як керований інструмент, чию роботу вбудовано в ланцюжок людських рішень — при тому, що обсяг і вартість його обчислень уже порівнянні з роботою цілого підрозділу.