Один користувач Reddit перейшов на Codex для особистих проєктів, але продовжив користуватися Claude Code на роботі. Його претензія стосувалася передусім інтерфейсу розширення Claude Code для VS Code, зокрема того, як у ньому відображаються виклики інструментів і субагенти. В іншій дискусії розробники описували, як використовують одного агента для внесення змін, а другого — для перевірки. Це окремі враження користувачів, а не результати тестування: умови в учасників різні, а користь перехресного рев’ю в цих історіях незалежно не вимірювали. Але вони підказують практичне запитання: який інструмент зручніший саме у вашому робочому процесі — і як це перевірити? Автор першого допису обговорює конкретно розширення для VS Code, а учасники другої дискусії діляться різними способами спільної роботи агентів.
Такі відгуки корисні як підказка, на що звернути увагу: інтерфейс, перевірка змін, ліміти та витрати. Але вони не визначають, який агент краще пише код. Щоб зробити вибір, варто відокремити особисті враження від систематичніших даних і порівнювати інструменти та умови, якими ви збираєтеся користуватися.
Порівнюйте не лише інструменти, а й середовище
Claude Code і Codex часто обговорюють як два варіанти одного й того самого продукту. Однак результат порівняння залежить не лише від моделі: має значення, чи запускаєте ви інструмент у терміналі, редакторі або хмарному середовищі.
4 лютого 2026 року GitHub оголосив про публічне попереднє тестування Claude і Codex в Agent HQ. Через GitHub агенту можна призначити завдання, а потім отримати pull request для перевірки. Але спільний інтерфейс не перетворює цей сценарій на лабораторне порівняння: моделі, налаштування та середовище виконання можуть відрізнятися. Це також не те саме, що локальний запуск Claude Code або Codex.
Згідно з актуальною документацією GitHub про сторонніх агентів, сесії витрачають хвилини GitHub Actions і кредити AI; витрати залежать від моделі та кількості оброблених токенів. Тому скарга на конкретне розширення не обов’язково стосується всіх способів роботи з Claude Code, а успішна хмарна сесія не гарантує, що той самий інструмент підійде для щоденної роботи в редакторі.
Що показують дані про pull request’и
У дослідженні, опублікованому 2026 року, автори проаналізували 7 156 pull request’ів п’яти агентів. Вони виявили, що частка прийнятих змін залежить від типу завдання: наприклад, Claude Code показав високі результати в документації та нових функціях, а Codex — у низці категорій, зокрема виправленнях і рефакторингу. Автори не виявили агента, який стабільно лідирував би в усіх категоріях. Докладніше про це йдеться в дослідженні прийняття pull request’ів.
Ці результати не відповідають на запитання, який продукт кращий у вашому репозиторії. Робота ґрунтується на публічних PR, створених у попередній період, а не на контрольованому тесті актуальних версій в однакових умовах. Вибірка Claude Code була значно меншою, ніж вибірка Codex: 139 PR проти 2 002. Крім того, прийняття PR не дорівнює якості коду: автори зазначають, що на результат можуть впливати репозиторій, досвід користувача та інші неконтрольовані чинники.
Дослідження корисне не як турнірна таблиця, а як нагадування: результат може залежати від завдання. Щоб з’ясувати, що підходить саме вам, варто перевірити інструменти на роботі, яку ви справді виконуєте.
Ліміти — не єдиний показник
В обговоренні лімітів на Reddit автор попросив порівняти, скільки практичного часу дають різні тарифи й моделі. Відповіді розходилися: наприклад, один учасник віддав перевагу Codex на молодшому рівні, а Claude — на дорожчих. Це особисті оцінки, а не вимірювання на однакових завданнях і з однаковими налаштуваннями. Обговорення лімітів не доводить, який сервіс вигідніший.
До того ж «ліміт» може означати обмеження на кілька годин, тижневу квоту або суб’єктивне відчуття, що підписки вистачає на звичне навантаження. 6 травня 2026 року Anthropic повідомила про збільшення п’ятигодинних лімітів Claude Code для низки планів і скасування зниження лімітів у години пік для Pro та Max. Це конкретна зміна умов, а не відповідь на запитання, скільки роботи отримає кожен користувач порівняно з Codex.
Під час власного порівняння записуйте тариф, модель, налаштування та спосіб запуску. Якщо один інструмент працює локально, а інший — через GitHub Agent HQ, різниця у витратах може бути пов’язана не лише з агентом, а й з умовами середовища.
Як порівняти інструменти у своєму репозиторії
Виберіть кілька завдань, схожих на щоденну роботу: виправлення помилки, невелику зміну функції та оновлення документації. Дайте кожному інструменту однаковий опис завдання й порівнянний доступ до репозиторію. Запишіть вибрані моделі та налаштування.
Потім оцініть не лише результат, а й витрати на перевірку:
- Чи пройшли наявні тести? Які перевірки довелося запускати або додавати вручну?
- Скільки разів довелося уточнювати завдання або втручатися у зміни?
- Наскільки легко зрозуміти й перевірити diff?
- Скільки часу тривала робота та які квоти або кредити вона використала?
- Чи були зайві зміни, пропущені вимоги або помилки?
Не зводьте завдання різних типів до одного бала без пояснень. Якщо хочете спробувати схему, у якій один агент вносить зміни, а інший їх перевіряє, розглядайте її як окремий процес: фіксуйте додатковий час і витрати, а зауваження рецензента перевіряйте самостійно. Відгуки користувачів можуть підказати такий варіант, але не доводять, що він надійніший чи економніший.
Обирати між Claude Code і Codex краще не за результатами голосування й не за однією історією переходу. Перевірте обидва інструменти на власних завданнях, у потрібному середовищі та з урахуванням реальних обмежень тарифу. Такий тест не дасть універсальної відповіді для всіх команд, але допоможе зрозуміти, який варіант підходить вашому робочому процесу.