Один пользователь Reddit перешёл на Codex для личных проектов, но продолжил пользоваться Claude Code на работе. Его претензия касалась прежде всего интерфейса расширения Claude Code для VS Code: в частности, того, как в нём отображаются вызовы инструментов и субагенты. В другой дискуссии разработчики описывали, как используют один агент для изменений, а второй — для проверки. Это отдельные пользовательские впечатления, а не результаты тестирования: условия у участников разные, а польза перекрёстного ревью в этих историях независимо не измерялась. Но они подсказывают практичный вопрос: какой инструмент удобнее именно в вашем рабочем процессе — и как это проверить? Автор первого поста обсуждает конкретно расширение для VS Code, а участники второй дискуссии делятся разными способами совместной работы агентов.
Такие отзывы полезны как подсказка, на что смотреть: интерфейс, проверка изменений, лимиты и расход. Но они не устанавливают, какой агент лучше пишет код. Для выбора стоит отделить личные впечатления от более систематических данных и сравнивать те инструменты и условия, которыми вы собираетесь пользоваться.
Сравнивайте не только инструменты, но и среду
Claude Code и Codex часто обсуждают как два варианта одного и того же продукта. Однако результат сравнения зависит не только от модели: имеет значение, запускаете ли вы инструмент в терминале, редакторе или облачной среде.
4 февраля 2026 года GitHub объявил публичное превью Claude и Codex в Agent HQ. Через GitHub агенту можно назначить задачу и затем получить pull request для проверки. Но общий интерфейс не превращает этот сценарий в лабораторное сравнение: модели, настройки и среда выполнения могут различаться. Это также не то же самое, что запуск Claude Code или Codex локально.
По актуальной документации GitHub о сторонних агентах, сессии расходуют минуты GitHub Actions и AI credits; затраты зависят от модели и числа обработанных токенов. Поэтому жалоба на конкретное расширение не обязательно относится ко всем способам работы с Claude Code, а успешная облачная сессия не гарантирует, что тот же инструмент подойдёт для повседневной работы в редакторе.
Что показывают данные о pull request’ах
В исследовании, опубликованном в 2026 году, авторы проанализировали 7 156 pull request’ов пяти агентов. Они обнаружили, что доля принятых изменений зависит от типа задачи: например, Claude Code показал высокие результаты в документации и новых функциях, а Codex — в ряде категорий, включая исправления и рефакторинг. Авторы не выявили агента, который стабильно лидировал бы во всех категориях. Подробности приведены в исследовании принятия pull request’ов.
Эти результаты не отвечают на вопрос, какой продукт лучше в вашем репозитории. Работа основана на публичных PR, созданных в более ранний период, а не на контролируемом тесте актуальных версий в одинаковых условиях. Выборка Claude Code была значительно меньше, чем выборка Codex: 139 PR против 2 002. Кроме того, принятие PR не равно качеству кода: авторы отмечают, что на результат могут влиять репозиторий, опыт пользователя и другие неконтролируемые факторы.
Исследование полезно не как турнирная таблица, а как напоминание: результат может зависеть от задачи. Чтобы выяснить, что подходит именно вам, стоит проверить инструменты на работе, которую вы действительно делаете.
Лимиты — не единый показатель
В Reddit-обсуждении лимитов автор попросил сравнить, сколько практического времени дают разные тарифы и модели. Ответы расходились: например, один участник предпочёл Codex на младшем уровне, а Claude — на более дорогих. Это личные оценки, а не измерение на одинаковых задачах и настройках. Обсуждение лимитов не доказывает, какой сервис выгоднее.
К тому же «лимит» может означать ограничение на несколько часов, недельную квоту или субъективное ощущение, что подписки хватает на привычную нагрузку. 6 мая 2026 года Anthropic сообщила об увеличении пятчасовых лимитов Claude Code для ряда планов и об отмене снижения лимитов в часы пик для Pro и Max. Это конкретное изменение условий, а не ответ на вопрос, сколько работы получит каждый пользователь по сравнению с Codex.
При собственном сравнении записывайте тариф, модель, настройки и способ запуска. Если один инструмент работает локально, а другой — через GitHub Agent HQ, разница в расходах может быть связана не только с агентом, но и с условиями среды.
Как сравнить инструменты в своём репозитории
Выберите несколько задач, похожих на повседневную работу: исправление бага, небольшое изменение функции и обновление документации. Дайте каждому инструменту одинаковое описание задачи и сопоставимый доступ к репозиторию. Запишите выбранные модели и настройки.
Затем оцените не только результат, но и затраты на проверку:
- Прошли ли существующие тесты? Какие проверки пришлось запускать или добавлять вручную?
- Сколько раз вам пришлось уточнять задачу или вмешиваться в изменения?
- Насколько легко понять и проверить diff?
- Сколько времени заняла работа и какие квоты или кредиты она использовала?
- Были ли лишние изменения, пропущенные требования или ошибки?
Не сводите задачи разных типов к одному баллу без пояснений. Если хотите попробовать схему, в которой один агент вносит изменения, а другой проверяет, учитывайте её как отдельный процесс: фиксируйте дополнительное время и расход, а замечания ревьюера проверяйте сами. Отзывы пользователей могут подсказать такой вариант, но не доказывают, что он надёжнее или экономичнее.
Выбирать между Claude Code и Codex лучше не по голосованию и не по одной истории перехода. Проверьте оба инструмента на своих задачах, в нужной среде и с учётом реальных ограничений тарифа. Такой тест не даст универсального ответа для всех команд, но поможет понять, какой вариант подходит вашему рабочему процессу.