jsonscraper

Claude Code или Codex: сравнивайте не бренд, а свою работу

Как выбрать между двумя агентами по собственным задачам, среде запуска и реальным ограничениям квот.

Один пользователь Reddit перешёл на Codex для личных проектов, но продолжил пользоваться Claude Code на работе. Его претензия касалась прежде всего интерфейса расширения Claude Code для VS Code: в частности, того, как в нём отображаются вызовы инструментов и субагенты. В другой дискуссии разработчики описывали, как используют один агент для изменений, а второй — для проверки. Это отдельные пользовательские впечатления, а не результаты тестирования: условия у участников разные, а польза перекрёстного ревью в этих историях независимо не измерялась. Но они подсказывают практичный вопрос: какой инструмент удобнее именно в вашем рабочем процессе — и как это проверить? Автор первого поста обсуждает конкретно расширение для VS Code, а участники второй дискуссии делятся разными способами совместной работы агентов.

Working Man
Sanni Sahil

Такие отзывы полезны как подсказка, на что смотреть: интерфейс, проверка изменений, лимиты и расход. Но они не устанавливают, какой агент лучше пишет код. Для выбора стоит отделить личные впечатления от более систематических данных и сравнивать те инструменты и условия, которыми вы собираетесь пользоваться.

Сравнивайте не только инструменты, но и среду

Claude Code и Codex часто обсуждают как два варианта одного и того же продукта. Однако результат сравнения зависит не только от модели: имеет значение, запускаете ли вы инструмент в терминале, редакторе или облачной среде.

4 февраля 2026 года GitHub объявил публичное превью Claude и Codex в Agent HQ. Через GitHub агенту можно назначить задачу и затем получить pull request для проверки. Но общий интерфейс не превращает этот сценарий в лабораторное сравнение: модели, настройки и среда выполнения могут различаться. Это также не то же самое, что запуск Claude Code или Codex локально.

По актуальной документации GitHub о сторонних агентах, сессии расходуют минуты GitHub Actions и AI credits; затраты зависят от модели и числа обработанных токенов. Поэтому жалоба на конкретное расширение не обязательно относится ко всем способам работы с Claude Code, а успешная облачная сессия не гарантирует, что тот же инструмент подойдёт для повседневной работы в редакторе.

Что показывают данные о pull request’ах

В исследовании, опубликованном в 2026 году, авторы проанализировали 7 156 pull request’ов пяти агентов. Они обнаружили, что доля принятых изменений зависит от типа задачи: например, Claude Code показал высокие результаты в документации и новых функциях, а Codex — в ряде категорий, включая исправления и рефакторинг. Авторы не выявили агента, который стабильно лидировал бы во всех категориях. Подробности приведены в исследовании принятия pull request’ов.

Эти результаты не отвечают на вопрос, какой продукт лучше в вашем репозитории. Работа основана на публичных PR, созданных в более ранний период, а не на контролируемом тесте актуальных версий в одинаковых условиях. Выборка Claude Code была значительно меньше, чем выборка Codex: 139 PR против 2 002. Кроме того, принятие PR не равно качеству кода: авторы отмечают, что на результат могут влиять репозиторий, опыт пользователя и другие неконтролируемые факторы.

Исследование полезно не как турнирная таблица, а как напоминание: результат может зависеть от задачи. Чтобы выяснить, что подходит именно вам, стоит проверить инструменты на работе, которую вы действительно делаете.

Лимиты — не единый показатель

В Reddit-обсуждении лимитов автор попросил сравнить, сколько практического времени дают разные тарифы и модели. Ответы расходились: например, один участник предпочёл Codex на младшем уровне, а Claude — на более дорогих. Это личные оценки, а не измерение на одинаковых задачах и настройках. Обсуждение лимитов не доказывает, какой сервис выгоднее.

К тому же «лимит» может означать ограничение на несколько часов, недельную квоту или субъективное ощущение, что подписки хватает на привычную нагрузку. 6 мая 2026 года Anthropic сообщила об увеличении пятчасовых лимитов Claude Code для ряда планов и об отмене снижения лимитов в часы пик для Pro и Max. Это конкретное изменение условий, а не ответ на вопрос, сколько работы получит каждый пользователь по сравнению с Codex.

При собственном сравнении записывайте тариф, модель, настройки и способ запуска. Если один инструмент работает локально, а другой — через GitHub Agent HQ, разница в расходах может быть связана не только с агентом, но и с условиями среды.

Как сравнить инструменты в своём репозитории

Выберите несколько задач, похожих на повседневную работу: исправление бага, небольшое изменение функции и обновление документации. Дайте каждому инструменту одинаковое описание задачи и сопоставимый доступ к репозиторию. Запишите выбранные модели и настройки.

Затем оцените не только результат, но и затраты на проверку:

  • Прошли ли существующие тесты? Какие проверки пришлось запускать или добавлять вручную?
  • Сколько раз вам пришлось уточнять задачу или вмешиваться в изменения?
  • Насколько легко понять и проверить diff?
  • Сколько времени заняла работа и какие квоты или кредиты она использовала?
  • Были ли лишние изменения, пропущенные требования или ошибки?

Не сводите задачи разных типов к одному баллу без пояснений. Если хотите попробовать схему, в которой один агент вносит изменения, а другой проверяет, учитывайте её как отдельный процесс: фиксируйте дополнительное время и расход, а замечания ревьюера проверяйте сами. Отзывы пользователей могут подсказать такой вариант, но не доказывают, что он надёжнее или экономичнее.

Выбирать между Claude Code и Codex лучше не по голосованию и не по одной истории перехода. Проверьте оба инструмента на своих задачах, в нужной среде и с учётом реальных ограничений тарифа. Такой тест не даст универсального ответа для всех команд, но поможет понять, какой вариант подходит вашему рабочему процессу.

Похожие материалы

Превратите прочитанное в рабочую интеграцию

Изучайте API социальных данных jsonscraper, тестируйте запросы и создавайте новые процессы.

Смотреть API