Codex vs Claude Code после исследования Microsoft: почему рост PR примерно на 24% — ещё не ответ

Исследование Microsoft показало: пользователи CLI-агентов объединяли примерно на 24% больше PR. Сравниваем Codex и Claude Code по процессам, лимитам и цене.

Thursday, September 3, 2026Omid Saffari
Codex vs Claude Code после исследования Microsoft: почему рост PR примерно на 24% — ещё не ответ

Новое исследование Microsoft о CLI-агентах выявило рост числа объединённых PR примерно на 24%, но оно не доказывает, что Claude Code превосходит Codex. Оно показывает другое: в споре Codex vs Claude Code главный вопрос теперь не «какая модель умнее?», а «какого агента команда действительно внедрит, продолжит использовать и сможет оплачивать при масштабировании?»

Главный вывод после исследования Microsoft

OpenAI Codex — лучший вариант по умолчанию, если нужен поток делегированных задач по разработке: много чётко ограниченных поручений, понятные окна использования и продукт, охватывающий веб, CLI, IDE, iOS, ревью кода и Slack.

Документация и страница продукта OpenAI Codex
OpenAI Codex

Claude Code — лучший вариант по умолчанию для задач, где важен прозрачный локальный контроль: работа прежде всего в терминале, управление из IDE, крупные репозитории и возможность наблюдать за действиями агента, а не только проверять готовый результат.

Страница документации Claude Code с работой в терминале и IDE
Claude Code

Исследование Microsoft меняет подход к выбору, потому что даёт категории реальную метрику внедрения. Авторы наблюдали за десятками тысяч инженеров Microsoft во время развёртывания Claude Code и GitHub Copilot CLI в начале 2026 года. Пользователи этих инструментов объединяли примерно на 24% больше PR, чем объединили бы без них, причём эффект сохранялся на протяжении четырёх месяцев. Это не бенчмарк Codex. Это предупреждение: агент с более удачным сценарием внедрения способен обойти агента с более эффектной демонстрацией.

Практическое решение простое: выбирайте Codex, если главное ограничение — объём делегированной работы на каждый потраченный доллар; выбирайте Claude Code, если важнее непосредственный инженерный контроль. Платить за оба инструмента стоит лишь тогда, когда у второго есть отдельная задача, с которой первый справляется хуже.

Кратко: Codex vs Claude Code в июле 2026 года

У Codex понятнее опубликованная таблица лимитов, а у Claude Code — лучше выстроен интерактивный локальный процесс. Этим различием объясняется почти весь выбор.

КритерийCodexClaude CodeЧто это означает
Начальная ценаFree — $0/month, Go — $8/month, Plus — $20/monthPro — $17/month при годовой оплате или $20/month при помесячнойУ Codex есть более доступные начальные тарифы; прямое сравнение начинается с $20.
Тариф для активной работыPro начинается с $100/month и даёт лимиты в 5x или 20x выше, чем PlusMax начинается с $100/month и даёт в 5x или 20x больше использования, чем ProОба сервиса подталкивают тех, кто активно работает каждый день, к тарифу за $100.
Опубликованные лимитыPlus даёт 15-80 локальных сообщений GPT-5.5 за 5-часовое окно; Pro 5x — 75-400; Pro 20x — 300-1600Лимиты Pro и Max общие для Claude и Claude Code; точное число сообщений публикуется не в таком же видеДо развёртывания Codex проще планировать по доступной ёмкости.
Основные интерфейсыВеб, CLI, расширение IDE, iOS, автоматическое ревью кода, интеграция со SlackТерминал, VS Code, Cursor и другие форки VS Code, IDE от JetBrains, веб и доступ через приложение ClaudeCodex сильнее в очередях делегированных задач; Claude Code — в интерактивной инженерной работе.
Работа сверх лимитаПользователи Plus и Pro могут покупать кредиты; работа по API-ключу оплачивается по стандартным тарифам APIПосле исчерпания лимита Claude Code может предложить API-кредиты с явного согласия пользователя; переменные окружения с API-ключом могут привести к оплате APIВ обоих случаях расходы могут перейти на модель оплаты по использованию, поэтому правила нужны ещё до начала спринта.

Если разработчик выбирает одну подписку для себя, начинать стоит с интерфейса, который действительно будет постоянно открыт. Тем, кто живёт в терминале и хочет работать с агентом бок о бок, лучше подходит Claude Code. Тем, чей день состоит из очереди задач, ревью и делегированной работы, — Codex.

Что на самом деле меняет исследование Microsoft

Исследование Microsoft доказывает, что схема внедрения не менее важна, чем выбор агента. Оно не утверждает, что «Claude Code на 24% лучше Codex». Codex не был тестируемым инструментом в этой работе. В исследованном развёртывании использовались Claude Code и GitHub Copilot CLI, а результат оценивали по числу объединённых PR, а не по выручке, влиянию на клиентов или сокращению дефектов.

Это различие принципиально: объединённые PR — полезный косвенный показатель продуктивности, но опасный управленческий ориентир. Команда может объединять на 24% больше PR и одновременно создавать дополнительную нагрузку на ревью, дробить изменения или чаще предлагать поверхностные исправления. Число всё равно важно: эффект сохранялся четыре месяца и был получен при крупном развёртывании в Microsoft. Однако без контроля качества интерпретировать его нельзя.

Для CTO самый важный вывод — не сами 24%. К первому использованию чаще всего подталкивали связи с коллегами, а удержание сильнее коррелировало с интенсивностью работы инженеров над кодом, чем с демографией. Проще говоря, активные разработчики чаще продолжали пользоваться этими инструментами, а заметный пример коллег ускорял их распространение.

Отсюда следует и план внедрения. Не стоит сразу покупать дорогого агента каждому инженеру и ждать чуда. Начните с разработчиков, которые уже выпускают много изменений, сделайте их рабочие процессы видимыми для остальных и измеряйте обычные операционные показатели: открытые PR, объединённые PR, время ревью, частоту откатов, дефекты, дошедшие до продакшена, и долю тех, кто продолжает использовать агента после четвёртой недели.

Codex выигрывает, когда узкое место — делегирование и расчёт лимитов

Codex выигрывает там, где работу можно передать в виде чётко сформулированных задач. OpenAI описывает Codex как агента для разработки ПО, который умеет писать код, разбираться в незнакомых кодовых базах, проводить ревью, искать и исправлять ошибки и автоматизировать разработку. Такое позиционирование важно: продукт больше похож на командный центр для работы агентов, чем на окно чата.

На текущей странице тарифов планирование ёмкости сделано на редкость конкретным. Plus стоит $20/month и включает Codex в вебе, CLI, расширении IDE и на iOS, а также облачные интеграции — например, автоматическое ревью кода и Slack. Pro начинается с $100/month и даёт в 5x или 20x больше использования Codex по сравнению с Plus.

Ключевая величина — 5-часовое окно. При работе с GPT-5.5 тариф Plus даёт 15-80 локальных сообщений за 5 часов, Pro 5x — 75-400, а Pro 20x — 300-1600. Это диапазоны, поскольку всё зависит от размера задачи и контекста, но общая картина достаточно ясна для планирования.

Для технического основателя, работающего в одиночку, Codex Plus — менее рискованная первая покупка, если задачи похожи на пункты из трекера: исправить ошибку, написать тесты для модуля, проверить PR, переделать эндпоинт или объяснить незнакомый сервис. Ограничение не в способности Codex рассуждать. Проблема в том, что для делегирования нужны точные требования. Расплывчатый запрос «сделай приложение лучше» израсходует то же 5-часовое окно быстрее, чем пять узких задач.

Для инженерной команды среднего бизнеса Codex становится привлекательным, когда руководитель умеет организовать настоящую очередь. Поручите агенту исправление тестов, миграции, первичное ревью кода, очистку зависимостей и обновление документации. Архитектуру и финальную проверку оставьте старшим инженерам. Именно здесь опубликованные лимиты полезны: можно заранее решить, достаточно ли тарифа за $20 участникам пилота или активных пользователей лучше сразу перевести на Pro 5x.

У Codex есть и преимущество в контроле расходов. OpenAI утверждает, что GPT-5.5 расходует значительно меньше токенов, достигая в Codex результатов, сопоставимых с GPT-5.4, и благодаря этой эффективности сервис может предлагать щедрые лимиты. Это заявление поставщика, а не независимый бенчмарк, но оно объясняет, почему цена Codex привязана к объёму работы.

Claude Code выигрывает, когда важны контроль и непосредственная работа инженера

Claude Code выигрывает там, где инженеру нужно оставаться рядом с задачей. Anthropic описывает его как инструмент программирования, который открывает доступ к моделям Claude прямо в терминале или поддерживаемой IDE, сохраняя прозрачность и контроль. Именно это словосочетание здесь главное: прозрачность и контроль.

Цены для индивидуальных пользователей устроены просто. Claude Pro стоит $17/month при годовой оплате — $200 списываются сразу — или $20/month при помесячной и включает Claude Code. Claude Max начинается с $100/month, даёт в 5x или 20x больше использования, чем Pro, а также повышенные лимиты вывода, ранний доступ и приоритетное обслуживание.

Механика тарифов Claude Code хуже подходит для расчётов в таблице, чем у Codex, потому что лимит общий для Claude и Claude Code. Если в один и тот же период активно пользоваться Claude для письма, исследований, анализа и программирования, всё это расходует общий лимит подписки. Само по себе это не недостаток, а лишь отличие, которое нужно учитывать при планировании. Основатель, который весь день обсуждает с Claude стратегию, а затем запускает Claude Code для работы над продакшеном, может исчерпать лимит раньше инженера, использующего подписку только в терминале.

Поддержка IDE — одна из главных причин выбрать Claude Code. На странице поддержки Anthropic указано, что Pro и Max включают Claude Code в VS Code, Cursor и других форках VS Code, а также IDE от JetBrains, включая IntelliJ и PyCharm. Для команд с локальными процессами, приватными репозиториями и инженерами, которые хотят проверять каждую команду, такой ежедневный сценарий удобнее полностью делегированной очереди.

Claude Code проще обосновать и для неоднозначных задач. Когда нужно «распутать этот процесс авторизации», «понять, почему эта очередь входит в дедлок» или «переработать старый сервис, не нарушив контракт», управляемый в процессе агент часто полезнее удалённого исполнителя, результат которого проверяют лишь в конце.

Есть важная оговорка по оплате. Если задана переменная окружения ANTHROPIC_API_KEY, Claude Code может использовать API-ключ вместо включённого в подписку объёма, что приводит к расходам по API. Anthropic также сообщает, что переход на использование API-кредитов требует явного согласия пользователя. Но команде всё равно нужна политика: кому разрешено включать кредиты, когда это допустимо и какие проекты оправдывают оплату по факту использования.

Правило расходов, которое подходит большинству команд

Первые $20 — не самая дорогая часть. По-настоящему дорого обходится неконтролируемое активное использование всей командой, которая не может объяснить, что именно изменилось в выпущенном результате.

На начальном уровне цены почти одинаковы: Codex Plus стоит $20/month, а Claude Pro — $20/month при помесячной оплате или $17/month при годовой. То же относится к старшим тарифам: Codex Pro начинается с $100/month, Claude Max — с $100/month. Разница заключается в устройстве лимитов.

Codex публикует более понятные диапазоны локальных сообщений для каждой модели и каждого 5-часового окна. Claude яснее позиционирует свои тарифы, но из-за общего лимита Claude и Claude Code реальная ёмкость зависит от того, насколько активно тот же пользователь обращается к Claude вне программирования. Поэтому расходы на Codex проще прогнозировать, а Claude удобнее вписывается в ежедневную работу.

При переходе на API сверх лимита главный риск смещается с цены подписки на стоимость токенов. API для Claude Opus 4.8 стоит $5 за миллион входных токенов и $25 за миллион выходных. До 31 августа 2026 года Sonnet 5 стоит $2 за миллион входных и $10 за миллион выходных токенов, а после этой даты — $3 и $15 соответственно. Эти цифры имеют значение лишь при разрешённом переходе на оплату по использованию, но тогда длинный спринт с агентом уже может не выглядеть как работа с продуктом за $20 или $100.

Трёхуровневый бюджет: лицензии за $20 для пробующих пользователей, за $100 — для проверенных активных пользователей, кредиты — только для конкретных процессов
Простая бюджетная лестница: лицензии за $20 для тех, кто пробует инструмент, за $100 — для проверенных активных пользователей, а кредиты — только для конкретного процесса с ответственным за расходы.

Кому какой инструмент выбрать

Codex — лучший первый выбор для делегированной работы, Claude Code — для интерактивной разработки. Преимущество переходит от одного к другому вместе со стилем работы.

СитуацияВыборПочему
Технический основатель с очередью небольших ошибок, тестов и документацииCodex PlusТариф за $20 даёт достаточно возможностей для структурированного делегирования, чтобы проверить пользу очередей для агента.
Старший инженер перерабатывает запутанную локальную кодовую базуClaude Pro или MaxКонтроль из терминала и IDE важнее опубликованных диапазонов сообщений.
Руководитель разработки стартапа внедряет агентов для 8 активных разработчиковНачните с Codex для очередей задач, а Claude Code дайте 2-3 пользователям с самой сложной локальной работойКоманда получает измеримый объём делегированной работы, не навязывая всем один процесс.
Команда с жёсткими регуляторными требованиями или повышенными требованиями к безопасностиСначала Claude Code со строгими правилами локальной работы и оплатыНепосредственный контроль, явное согласие на API-кредиты и процессы в IDE проще контролировать.
Платформенная команда с множеством регулярных задач по обслуживаниюCodex Pro 5xОпубликованные 5-часовые окна и облачное делегирование подходят для повторяющихся очередей задач агента.
Продуктовой команде нужны и прототипирование, и реализацияОба, но для разных задачИспользуйте Claude Code, чтобы продумать изменение, а Codex — чтобы выполнить чётко ограниченные последующие задачи.

Ошибка — покупать оба инструмента лишь потому, что сравнение не даёт очевидного победителя. Второй нужен только для отдельной работы. Если оба агента исправляют одни и те же ошибки, вы тестируете личные предпочтения, а не строите рабочую модель.

План внедрения: как получить рост на 24% и не платить за неиспользуемые лицензии

Начните с инженеров, которые с наибольшей вероятностью продолжат пользоваться агентом. В исследовании Microsoft удержание было связано с интенсивностью программирования, поэтому в первую группу должны войти активные разработчики, а не максимально широкий срез оргструктуры.

  1. Отберите первую группу по активности в коде

    Выберите 5-10 инженеров, которые регулярно объединяют изменения и работают с кодовыми базами, где достаточно рутинных задач для делегирования. Не начинайте с руководителей, редких авторов коммитов или людей, которых ещё нужно убедить хотя бы открыть агента для программирования.

  2. Сделайте использование видимым

    Публикуйте полезные промпты, созданные агентом PR и заметки после ревью в общем канале. Исследование показало, что первое использование распространялось через социальные связи, поэтому незаметная индивидуальная работа замедляет внедрение.

  3. Разделите работу между агентами

    Отдайте Codex задачи из очереди: тесты, ревью, миграции, документацию и ограниченные по объёму исправления. Claude Code поручите локальную работу: исследовательскую отладку, неоднозначные рефакторинги, сессии в IDE и изменения, требующие постоянного контроля.

  4. Измеряйте результат и сопутствующую нагрузку

    Отслеживайте объединённые PR, время ревью, отклонённые PR, откаты, дефекты, дошедшие до продакшена, и активность тех же пользователей через четыре недели. Большее число PR приносит пользу лишь до тех пор, пока система ревью справляется с нагрузкой.

  5. Расширяйте внедрение только после подтверждения удержания

    Переводите пользователей с пробных мест на тарифы за $100, когда у них появляется повторяемый рабочий процесс. Добавляйте кредиты только для конкретных процессов с ответственным за бюджет.

Именно здесь цифра Microsoft становится полезной. Она даёт командам основание всерьёз относиться к агентам для программирования, но одновременно указывает на главный рычаг внедрения: распространение через коллег среди тех, кто уже много работает с кодом.

Итог

Codex лучше подходит для задач, которые можно чётко сформулировать и делегировать. Claude Code — для работы, где инженер должен оставаться в контуре. Исследование Microsoft повышает доверие к обоим подходам, но выбирать всё равно нужно по рабочему процессу.

Если вы уже читали исходное сравнение Codex и Claude Code, главное обновление таково: схема внедрения теперь не менее важна, чем личный выбор инструмента. Если проблема в лимитах Claude, по-прежнему пригодится расчёт перехода при недельных ограничениях. А если нужно понять, заслуживает ли Codex отдельной строки бюджета, обратитесь к расчёту P&L для основателя — это финансовая сторона того же решения.

Codex CLI дешевле Claude Code?

На начальном уровне цены практически одинаковы: Codex Plus стоит $20/month, Claude Pro — $20/month при помесячной оплате или $17/month при годовой. Codex проще планировать, поскольку OpenAI публикует диапазоны локальных сообщений для 5-часовых окон. Расход Claude Code прогнозировать сложнее, потому что лимиты Pro и Max общие для Claude и Claude Code.

Claude Code лучше Codex?

Claude Code лучше подходит для интерактивной работы в терминале и IDE, когда действия агента нужно постоянно направлять. Codex удобнее для очередей делегированных задач, автоматического ревью кода, процессов с интеграцией в Slack и команд, которым нужны более понятные опубликованные окна использования.

За что платить: Codex или Claude Code?

Выбирайте Codex, если работу можно разбить на ограниченные задачи и поставить в очередь. Платите за Claude Code, если работа неоднозначна, выполняется локально и требует тщательного ревью. Оба инструмента нужны лишь тогда, когда у каждого есть своя роль.

Можно ли пользоваться Claude Code или Codex бесплатно?

У Codex есть тариф Free за $0/month для быстрых задач по программированию, а также Go за $8/month. Для индивидуальных пользователей Claude Code входит в Claude Pro и Max, поэтому фактическая начальная цена — Claude Pro за $20/month при помесячной оплате или $17/month при годовой.

Что доказало исследование Microsoft о CLI-агентах?

Оно доказало, что крупное внедрение CLI-агентов для программирования способно дать измеримый прирост результата, если пользователи принимают инструмент. У участников было примерно на 24% больше объединённых PR, но PR служили косвенным показателем, и работа не доказывала, что каждый дополнительный PR приносил одинаковую ценность бизнесу.

Последнее обновление

3 сент. 2026 г.

КатегорияAI

Сделать этот сайт предпочтительным в Google

Добавить omidsaffari.com как предпочтительный источник в Google Поиске

Отметьте omidsaffari.com как предпочтительный источник — и Google будет поднимать его для вас в Top Stories, AI Overviews и AI Mode.

Рассылка

Одно письмо, каждое воскресенье. Работающие системы, а не горячие мнения.

Билд-логи, системы в продакшене и полевые заметки из портфеля ИИ-проектов.

Еженедельно. Без спама. Отписка в любой момент.