Codex CLI 0.152.0: как устроен лимит вывода MCP
Разбираем Codex CLI 0.152.0: лимит вывода MCP для каждого инструмента, новые тайм-ауты app server, поиск Vim и понятные статусы восстановления.

Codex CLI 0.152.0 вышел 1 сентября 2026 года и получил шесть новых функций, однако суть релиза — в более чётких границах для долгих запусков с большим числом инструментов. Главное нововведение — лимит вывода MCP для каждого инструмента: теперь можно отдельно ограничить объём данных, который увидит модель, а не применять ко всем один и тот же резервный сценарий.
Если кратко
Это релиз про контроль и надёжность, а не новая модель или изменение цен. Если Codex используется как обычный ИИ-агент для программирования в терминале, заметнее всего станут более понятные сообщения об ограничениях, прозрачное восстановление учётных данных и поиск Vim в длинных черновиках.
Тем, кто подключает Codex к внешним системам через MCP или строит решения на app server Codex, обновление даёт больше. MCP, или Model Context Protocol, — это связующий слой, через который Codex обращается к поиску по документации, Figma, GitHub и внутренним сервисам. В версии 0.152.0 каждому такому инструменту можно назначить собственный бюджет вывода.
Вот шесть новых функций релиза — с пояснением, кому они пригодятся:
Разобраться прежде всего стоит с первой строкой: она определяет, сколько данных от инструментов Codex сохраняет для дальнейшей работы.
Как работает лимит вывода MCP
MCP-инструмент способен вернуть очень много данных. Поиск по документации может принести несколько длинных страниц, а поиск по логам — множество строк. Codex должен поместить этот результат в рабочий контекст, то есть в краткосрочную память модели для текущей задачи.
Если отдельная настройка для инструмента отсутствует, вывод MCP по-прежнему обрезается по стандартным правилам активной модели. В версии 0.152.0 у конкретного инструмента конкретного MCP-сервера можно указать новый параметр output_token_limit. Тогда Codex сократит видимый модели результат до заданного бюджета токенов.
Ключевые слова здесь — видимый модели. MCP-сервер не выполняет меньше работы, а Code Mode по-прежнему получает исходный результат целиком. Ограничение срабатывает, когда данные попадают в контекст модели и историю диалога. Тот же эффективный бюджет Codex применяет в возобновлённых сессиях и к ответам хуков после вызова инструмента, поэтому повторное открытие треда не вернёт незаметно более объёмный результат.

Зачем это нужно
Теперь вопрос звучит не «сколько вывода инструментов выдержит эта модель?», а «сколько данных нужно именно этому инструменту для работы?». Справочный запрос по библиотеке и выгрузка производственных логов больше не обязаны получать одинаковый бюджет.
Предусмотрены два защитных правила. Значение должно быть положительным: 0 и отрицательные числа отклоняются. Если лимит задан и политикой плагина, и собственной конфигурацией пользователя, применяется меньшее значение. Разрешение на запуск инструмента настраивается отдельно, поэтому сокращение бюджета вывода не даёт инструменту одобрение и не меняет момент, когда Codex просит разрешить его вызов.
Кому и как пригодится новая настройка
Разработчику с многословным поиском по документации
Разработчик небольшого SaaS-проекта может не позволить широкому поиску по документации занять весь оставшийся контекст текущего сеанса программирования. Достаточно назначить явный бюджет инструменту, который возвращает длинные страницы, и не ограничивать точные справочные запросы. В рабочем контексте останется больше места для репозитория, плана и diff.
Для версии 0.152.0 это самый наглядный сценарий: граница проходит там, где возникает лишний объём. Не нужно урезать все инструменты только из-за того, что один из них возвращает слишком много.
Платформенному инженеру с долгими задачами app server
Новое поле timeoutMs относится к методу app server thread/shellCommand. Это не настройка MCP tool_timeout_sec.
Разница существенна. Стандартный тайм-аут выполнения MCP-инструментов сейчас составляет 60 секунд. Для shell-команды app server по умолчанию остаётся один час, если timeoutMs не указан или равен null. Теперь клиент app server может запросить больший срок, когда известно, что сборка, миграция или набор тестов требуют больше времени. Значение timeoutMs, равное 0, приводит к немедленному тайм-ауту, а недопустимые отрицательные значения отклоняются.
Тайм-аут этой вспомогательной команды не останавливает активный ход агента. Клиенту нужно отдельно решить, должен ли агент продолжить работу, получить новые указания или быть прерван.
Разработчику, который пишет длинные задания в Vim
Режим Vim теперь умеет искать по самому черновику. / выполняет поиск вперёд, ? — назад, а n и N повторяют поиск с переходом через границу текста. Поиск также сочетается с операциями удаления, изменения и копирования, при этом запрос не попадает в текст промпта.
В коротком задании это мелочь. Но при работе с многоабзацными инструкциями в терминале больше не придётся переносить текст в редактор только ради поиска и замены повторяющегося имени.
Корпоративной команде, использующей Bedrock
Истёкшие учётные данные поставщика раньше легко было принять за зависший запуск. Теперь Codex отправляет стабильные уведомления о начале и завершении восстановления аутентификации поставщика и показывает процесс как в интерактивном TUI, так и в codex exec.
Для инженерной команды, работающей через Amazon Bedrock, это даёт операционную прозрачность. По журналу CI можно отличить «агент работает» от «сессия поставщика проходит повторную аутентификацию», не пытаясь угадать причину долгой паузы.
Автору плагина, которому нужны настоящие имена пакетов
В именах MCP-серверов теперь допустимы :, @, / и .. Такое имя, как npm:@modelcontextprotocol/server-sequential.thinking, проходит через команды mcp add, get, list и remove, а затем сохраняется без изменений в пространствах имён инструментов среды выполнения и учётных данных OAuth.
Одним скучным источником псевдонимов становится меньше. Координата пакета, имя в конфигурации и идентификатор учётных данных могут совпадать.
Команде, которая регулярно упирается в лимиты
Теперь терминал умеет превращать уведомление об ограничении в конкретное действие. Поддерживаемые баннеры могут вести к статистике использования, кредитам, сроку сброса, уведомлению владельца или управлению тарифом. Во время восстановления Codex обновляет сведения об использовании, отбрасывает устаревшие ответы и приостанавливает ввод из очереди, пока состояние не станет актуальным. Баннер с бэкенда также может переключить его на первую доступную резервную модель, не меняя прочие настройки треда.
Доступный объём от этого не увеличивается. Зато граница становится понятной, а терминал предлагает полезный следующий шаг.
Полная настройка на реальном MCP-сервере
Проще всего увидеть новую конфигурацию на примере Context7 — MCP-сервера документации из руководства по настройке Codex. Его инструмент query-docs получает документацию по известному идентификатору библиотеки, поэтому явный бюджет вывода здесь вполне уместен.
Установите релиз
Зафиксируйте нужную версию, чтобы новый параметр конфигурации был доступен:
Bashnpm install -g @openai/codex@0.152.0Добавьте Context7
Используйте точную команду из актуального руководства Codex по MCP:
Bashcodex mcp add context7 -- npx -y @upstash/context7-mcpЗадайте бюджет инструмента
Откройте
~/.codex/config.tomlи добавьте эту таблицу после записи сервера Context7:TOML[mcp_servers.context7.tools.query-docs] output_token_limit = 30000Значение
30,000взято из собственного теста сериализации Codex. Оно показывает допустимый формат, а не универсальную рекомендацию. Начните с минимального объёма, при котором сохраняются нужные промптам свидетельства, а затем увеличьте его, если реальные результаты окажутся обрезанными.Проверьте подключение
Выполните
codex mcp list, чтобы убедиться, что сервер настроен. В интерфейсе терминала команда/mcpпоказывает активные серверы, доступные в текущей сессии.
О чём важно помнить
Обрезка вывода для отдельных инструментов — это страховочная граница, а не бесплатное сжатие. Если занизить лимит, Codex может не увидеть ключевую строку лога или оговорку в документации, которая объясняет проблему. Поскольку при пересечении политик плагина и пользователя побеждает меньшее значение, политика плагина тоже может опустить фактический бюджет ниже числа в вашем файле.
Кроме того, заданный бюджет применяется до стандартного 20%-го запаса на сериализацию — дополнительную структуру, необходимую для включения результата в запрос к модели. Считайте его практическим ориентиром, а не обещанием, что каждый сериализованный пакет будет содержать ровно столько токенов.
Остальные изменения 0.152.0 — полезное техническое обслуживание. Возобновлённые треды восстанавливают сохранённый рабочий каталог, если вызывающая сторона не передала другой. Автоматическая проверка разрешений сохраняет больше инструкций и действующих авторизаций после сжатия истории. MCP-инструменты надёжнее переживают обновление кеша и изменения удалённых плагинов. Ничто из этого не меняет способности модели писать код, цену тарифа или доступный объём использования.
Стоит ли обновляться сейчас
Обновитесь на этой неделе, если используете несколько MCP-инструментов, встраиваете app server, пишете длинные промпты в режиме Vim, работаете через Bedrock или регулярно достигаете лимитов. Это прямые улучшения рабочего процесса с небольшим объёмом миграции.
Можно подождать, если версии CLI в организации закрепляются централизованно. Публичная документация по конфигурации ещё не описывает параметр вывода для отдельных инструментов, поэтому владельцу набора политик стоит дать время проверить новое поле и выбрать лимиты на основе реальных результатов.
Если вы пользуетесь только ChatGPT в браузере или мобильном приложении, этот релиз ничего не меняет в вашем процессе. Тем, кто ещё решает, подходит ли Codex для их способа выпускать продукты, лучше начать с общего сравнения Codex, Claude Code и Cursor.
Чтобы получать больше понятных разборов релизов, которые меняют рабочий процесс разработки, подпишитесь на рассылку.
2 сент. 2026 г.



