OpenAI представила Codex CLI: новые возможности для разработчиков

Компания OpenAI выпустила технический анализ Codex CLI — локального инструмента для взаимодействия с кодом на компьютере. Это руководство будет особенно полезно для разработчиков, создающих собственные агенты и стремящихся оптимизировать затраты на инференс и работу с контекстом.

Codex CLI базируется на классическом цикле агентов: пользователь отправляет запрос, после чего система формирует расширенный промпт с инструкциями. Модель реагирует текстом или вызывает инструмент, результат которого добавляется в контекст, и процесс повторяется до завершения задачи. Следует помнить о жестком лимите: все инструкции из AGENTS.md и корневых директорий проекта объединяются в JSON, не превышающий 32 Кб.

Также акцентировано внимание на стоимости контекста — при каждом шаге диалог растет, что может повлечь значительные затраты. Чтобы контролировать стоимость, применяют кэширование промптов, при этом важно следить за порядком инструментов и конфигурации для сохранения кэша и снижения цен на запросы.

Кроме того, архитектура API Codex CLI перешла на безсостояние. Параметр previous_response_id был убран для поддержки режима Zero Data Retention, при этом никакая информация не хранится на стороне провайдера.

Когда контекст достигает предела, автоматически включается компакция: старые сообщения сжимаются в компактный блок, сохраняя их смысл. Процесс запускается при достижении определенного лимита.

Открытый флаг –oss позволяет использовать Codex CLI с локальными моделями, например, Ollama или LM Studio. В будущем OpenAI обещает подробнее обсудить архитектуру CLI и модель песочницы Codex.

Вопрос-ответ

Какие ключевые функции предоставляет Codex CLI и как они влияют на работу с контекстом?

Codex CLI реализует классический цикл агентов: пользователь формирует запрос, инструмент формирует расширенный промпт, модель отвечает текстом или вызывает инструмент, его результат добавляется в контекст и цикл повторяется до завершения задачи. Важные моменты: ограничение на объединение инструкций из AGENTS.md и корневых директорий проекта в JSON не более 32 Кб; управление контекстом напрямую влияет на стоимость инференса.

Как контролируется стоимость контекста и какие методы экономии применяются?

Стоимость контекста растет с каждым шагом диалога, поэтому применяют кэширование промптов и следят за порядком инструментов и конфигурации, чтобы сохранить кэш и снизить цену на запросы. Также компактация контекста при достижении лимита помогает сохранить смысл, снижая объем данных в рамках одного сеанса.

Что изменилось в архитектуре Codex CLI и как это влияет на хранение данных?

Архитектура API Codex CLI перешла на безсостояние: удалён параметр previous_response_id, поддержан режим Zero Data Retention, и никакая информация не хранится на стороне провайдера. Это повышает приватность и упрощает работу в локальном режиме с нулевым сохранением данных.

Как можно использовать Codex CLI локально и какие будущие планы упоминались в статье?

Флаг opensource -oss позволяет использовать Codex CLI с локальными моделями, такими как Ollama или LM Studio. В будущем OpenAI планирует обсудить архитектуру CLI и концепцию песочницы Codex более подробно, что может повлиять на расширяемость и безопасность локальных внедрений.

Вам также может понравиться...