OpenAI отдала разработчикам движок Codex под многодневных агентов
Codex — среда OpenAI , где агент сам правит код в изолированном окружении и работает подолгу без присмотра. Инфраструктуру под него компания собирала больше года, а теперь отдаёт наружу под именем Agents API . Бета открыта всем разработчикам, без списков ожидания и отдельной заявки.
Агент не забывает начало задачи на вторые сутки
Главная боль долгоживущих агентов — окно контекста. Через несколько часов работы история упирается в предел, и разработчику приходится самому решать, что выбросить, что пересказать короче и как не потерять условия задачи. Agents API берёт это на себя и подрезает раннюю часть истории автоматически, по мере приближения к лимиту.
OpenAI обещает часы непрерывной работы, а на длинных сценариях — задачи продолжительностью в несколько дней. Обратную сторону компания не проговаривает. Автоматическое сжатие само решает, какие детали задачи считать неважными, и разработчик узнаёт о его выборе по результату.
Подагенты идут параллельно, каждый со своим контекстом
Второй механизм Agents API — разделение работы. Главный агент раздаёт куски задачи подагентам, те работают параллельно, и у каждого своя история, которая не забивает общее окно. Инструменты тоже вызываются пачкой, а не по одному.
Рядом появился tool search, подгрузка описаний инструментов по мере надобности. Когда у агента полсотни доступных функций, их описания съедают контекст ещё до первого полезного действия. Выборочная подгрузка экономит на этом заметно. Поддерживаются протокол MCP, собственные функции разработчика и встроенный веб-поиск.
Песочница OpenAI или Modal, Cloudflare и E2B
Агенту нужно место, где он запускает код. Agents API даёт на выбор изолированные среды самой OpenAI, те же, что стоят под Codex, либо инфраструктуру разработчика. На старте заявлены интеграции с Modal, Cloudflare, E2B, DigitalOcean, Oracle, Vercel, Runloop, Daytona и Blaxel.
Список читается как попытка снять главное возражение корпоративных заказчиков. Код и данные остаются в периметре заказчика, а управление агентом всё равно у OpenAI.
Ciridae, SafetyKit и Hypha называют свои цифры
В анонс OpenAI собрала замеры ранних клиентов.
- Ciridae — оценка качества агента выросла с 0,71 до 0,85, задержка ответа упала вчетверо после перехода на подагентов;
- SafetyKit — стоимость обработки одного обращения снизилась на 60%;
- Hypha — на 86% меньше неудачных ответов агента;
- Nash.ai — сотни миллионов доставок, которыми управляют долгие сессии.
Все четыре цифры пришли от самих клиентов через пресс-релиз OpenAI. С чем именно сравнивали, ни одна компания не уточняет, и на какой обвязке агенты работали до перехода, тоже не сказано.
Платы за API нет, счёт за токены остаётся
Отдельного тарифа у Agents API действительно нет, разработчик платит за токены моделей и за вызовы инструментов. Звучит щедро ровно до того момента, пока агент не пойдёт над задачей вторые сутки. Многодневный прогон с подагентами и параллельными вызовами инструментов — это в первую очередь расход токенов, и предсказать его до запуска сложнее, чем стоимость обычного запроса.
Из моделей в примерах OpenAI фигурирует gpt-6-astra, флагман, вышедший в начале сентября. Для российских разработчиков остаётся привычная оговорка. Прямой доступ к API OpenAI из страны закрыт, платить приходится зарубежной картой или через посредника.
Сколько стоят сутки автономной работы
Agents API снимает с разработчика самую скучную часть работы над агентами — управление контекстом, песочницами и долгими сессиями. Это ровно то место, где обычно застревают команды, которые довели прототип до демо и не могут довести до продакшена. Открытый вопрос один. Окупается ли сутки автономной работы против десятка коротких запросов с человеком в цикле, и ответ на него будет виден в октябрьских счетах первых команд, а не в бенчмарках.