OpenAI заявила о создании автоматизированного исследователя-стажёра
Компания отчиталась о новом уровне автоматизации исследований. Разбираем, что означает слово «стажёр», как читать показатели агентной работы и где проходит граница самостоятельности ИИ.

Исследователи OpenAI уже могут поручать агентам чётко поставленные задачи на несколько дней под руководством человека, заявила компания 6 сентября. По собственным измерениям OpenAI, её системы достигли уровня «автоматизированного исследователя-стажёра».
Ключевые выводы
Стажёр работает под надзором
- Чётко поставленные задачи под надзором человека.
- 3,1 дня работы агентов на день человека показывают объём использования, а не ускорение исследований.
- Данные внутренние и предварительные; независимой проверки в отчёте нет.
Что измерила OpenAI
По данным OpenAI, к середине августа медианный по использованию агентов исследователь расходовал на инференс более $600 в день по API-ценам; у 10% самых активных пользователей показатель превышал $7000 в день. Инференс — выполнение запросов к модели. По всей исследовательской организации на восьмичасовой день человеческой работы приходилось 3,1 агентного рабочего дня.
Более половины успешных задач на 4–8 часов человеческой работы за последние шесть месяцев сопровождались хотя бы одним вмешательством человека. Люди выбирают приоритеты и решают, масштабировать, остановить или развернуть систему. Рост числа экспериментов коррелировал с распространением Codex, но одновременно выросли вычислительные ресурсы. Публикация не позволяет приписать изменение одному фактору.
Как интерпретировать заявление OpenAI
Разработчик Саймон Уиллисон обратил внимание на резкий рост расходов на агентов в конце июля. Он предположил, что тогда сотрудники получили внутренний доступ к модели, которую позднее выпустили как GPT-6 Astra. Ниже — перевод его гипотезы; сам график причину скачка не устанавливает.
Моя главная гипотеза: именно тогда сотрудники получили доступ к модели, позднее выпущенной как GPT-6 Astra.
Короткие ответы
К какому сроку OpenAI рассчитывает создать автоматизированного ИИ-исследователя?
Собственная цель OpenAI — март 2028 года. Это ориентир компании, а не гарантированная дата появления автономного учёного. При оценке такого обещания нужны конкретные критерии: какие задачи система выполняет, как проверяют результат, кто выбирает направление работы и сколько помощи требуется на каждом этапе.
Доказывает ли отчёт достижение AGI?
Нет. AGI означает общий искусственный интеллект. Выполнение ограниченных задач и способность самостоятельно вести исследования требуют разных проверок. Поэтому приравнивать эти показатели к AGI было бы необоснованно. Само название «стажёр» тоже не заменяет проверку: нужно знать условия, критерии успеха и объём человеческой помощи.
Что проверять при внедрении агентов?
Считайте долю результатов, принятых без правок, время постановки и проверки задачи, стоимость запросов и исправлений, число вмешательств человека. Сравнивайте одинаковые задачи с агентом и без него. Рост числа запросов или часов работы агента сам по себе ещё не показывает, сколько полезной работы получила команда.
Сравнивая отчёт OpenAI со своей практикой, проверьте главный показатель: сокращается ли путь от поставленной задачи до результата, который человек готов принять.













