До сих пор разработчик мог собрать агента на Agents SDK, но значительную часть инфраструктуры все равно приходилось запускать и обслуживать самому. Agents API меняет эту границу: OpenAI берет на себя Codex harness, который управляет обращениями к модели, инструментами и контекстом, а среду выполнения можно оставить у себя, выбрать сторонний sandbox или использовать размещенную OpenAI среду.
Самая любопытная часть здесь связана с длинными задачами. Когда сессия приближается к пределу контекста, API автоматически сжимает раннюю часть истории, сохраняя сведения, нужные для продолжения работы. Разработчику не требуется самостоятельно строить механизм переноса состояния между окнами контекста. Для задач, которые идут несколько часов или дней, это существенное отличие от обычной цепочки запросов к модели.
В тот же контур входят поиск нужных инструментов, программный вызов нескольких инструментов и параллельные субагенты. В опубликованном примере одновременно разрешены три субагента, но это пример конфигурации, а не заявленный общий предел сервиса.

Публичная бета доступна всем разработчикам. Отдельной платы за Agents API сейчас нет: оплачиваются используемые модели и инструменты. Поэтому главный смысл запуска не в новом способе вызвать модель, а в возможности передать OpenAI обслуживание агентного цикла, сохранив выбор среды, где фактически выполняется работа.








