Jeden uživatel Redditu přešel u osobních projektů na Codex, ale v práci dál používal Claude Code. Jeho výhrady se týkaly především rozšíření Claude Code pro VS Code, zejména způsobu, jakým zobrazuje volání nástrojů a subagenty. V jiné diskusi vývojáři popisovali, jak jednoho agenta používají k provádění změn a druhého k jejich kontrole. Jde o individuální zkušenosti, nikoli o výsledky testování: podmínky se u účastníků liší a přínos vzájemné kontroly nebyl v těchto příbězích nezávisle měřen. Nabízejí však praktickou otázku: který nástroj se hodí právě do vašeho pracovního postupu — a jak to ověřit? Autor prvního příspěvku se věnuje konkrétně rozšíření pro VS Code, zatímco účastníci druhé diskuse sdílejí různé způsoby spolupráce agentů.
Takové ohlasy napovídají, na co se zaměřit: rozhraní, kontrolu změn, limity a spotřebu. Neurčují však, který agent píše lepší kód. Při výběru je dobré oddělit osobní dojmy od systematičtějších údajů a porovnávat nástroje v podmínkách, ve kterých je chcete používat.
Porovnávejte nejen nástroje, ale i prostředí
Claude Code a Codex se často probírají jako dvě varianty téhož produktu. Výsledek srovnání však nezávisí jen na modelu: záleží také na tom, zda nástroj spouštíte v terminálu, editoru, nebo cloudovém prostředí.
4. února 2026 GitHub oznámil veřejné preview Claude a Codex v Agent HQ. Prostřednictvím GitHubu lze agentovi zadat úkol a následně získat pull request ke kontrole. Společné rozhraní ale z tohoto scénáře nedělá laboratorní srovnání: modely, nastavení i prostředí, ve kterém se spouštějí, se mohou lišit. Nejde ani o totéž jako lokální spuštění Claude Code nebo Codexu.
Podle aktuální dokumentace GitHubu o agentech třetích stran se při relacích spotřebovávají minuty GitHub Actions a AI kredity; náklady závisí na modelu a počtu zpracovaných tokenů. Stížnost na konkrétní rozšíření se proto nemusí vztahovat na všechny způsoby používání Claude Code a úspěšná cloudová relace nezaručuje, že se stejný nástroj hodí pro každodenní práci v editoru.
Co ukazují data o pull requestech
Ve studii publikované v roce 2026 autoři analyzovali 7 156 pull requestů vytvořených pěti agenty. Zjistili, že podíl přijatých změn závisí na typu úkolu: Claude Code dosáhl například dobrých výsledků v dokumentaci a nových funkcích, zatímco Codex v několika kategoriích včetně oprav a refaktorování. Autoři nenašli agenta, který by stabilně vedl ve všech kategoriích. Podrobnosti uvádí studie o přijímání pull requestů.
Tyto výsledky neodpovídají na otázku, který produkt je lepší ve vašem repozitáři. Studie vychází z veřejných PR vytvořených v dřívějším období, nikoli z kontrolovaného testu aktuálních verzí za stejných podmínek. Vzorek Claude Code byl výrazně menší než vzorek Codexu: 139 PR oproti 2 002. Přijetí PR navíc není totéž co kvalita kódu: autoři upozorňují, že výsledek mohou ovlivnit repozitář, zkušenosti uživatele a další nekontrolované faktory.
Studie je užitečná nikoli jako žebříček, ale jako připomínka, že výsledky se mohou lišit podle úkolu. Chcete-li zjistit, co vyhovuje právě vám, vyzkoušejte nástroje na práci, kterou skutečně děláte.
Limity nejsou jediný ukazatel
V diskusi o limitech na Redditu požádal autor ostatní o srovnání toho, kolik času na praktickou práci nabízejí různé tarify a modely. Odpovědi se lišily: jeden účastník například upřednostnil Codex u nižšího tarifu a Claude u dražšího. Jde o osobní hodnocení, nikoli o měření na stejných úkolech a se stejným nastavením. Diskuse o limitech nedokazuje, která služba nabízí lepší poměr ceny a výkonu.
„Limit“ navíc může znamenat omezení na několik hodin, týdenní kvótu nebo subjektivní pocit, že předplatné stačí na obvyklou zátěž. Anthropic 6. května 2026 oznámila zvýšení pětihodinových limitů Claude Code u několika tarifů a zrušení snížení limitů ve špičce pro Pro a Max. Jde o konkrétní změnu podmínek, nikoli o odpověď na otázku, kolik práce každý uživatel zvládne ve srovnání s Codexem.
Při vlastním srovnání si zaznamenávejte tarif, model, nastavení a způsob spuštění. Pokud jeden nástroj běží lokálně a druhý přes GitHub Agent HQ, rozdíl ve spotřebě může souviset nejen s agentem, ale i s podmínkami prostředí.
Jak porovnat nástroje ve vlastním repozitáři
Vyberte několik úkolů podobných každodenní práci: opravu chyby, drobnou změnu funkce a aktualizaci dokumentace. Každému nástroji zadejte stejný popis úkolu a srovnatelný přístup k repozitáři. Zaznamenejte zvolené modely a nastavení.
Potom hodnoťte nejen výsledek, ale také náklady na kontrolu:
- Prošly stávající testy? Jaké kontroly jste museli spustit nebo přidat ručně?
- Kolikrát jste museli upřesnit zadání nebo zasáhnout do změn?
- Jak snadné je pochopit a zkontrolovat diff?
- Kolik času práce zabrala a jaké kvóty nebo kredity spotřebovala?
- Objevily se zbytečné změny, opomenuté požadavky nebo chyby?
Neslučujte úkoly různých typů do jediného skóre bez vysvětlení. Pokud chcete vyzkoušet postup, při kterém jeden agent provádí změny a druhý je kontroluje, berte jej jako samostatný pracovní postup: zaznamenejte dodatečný čas a spotřebu a připomínky kontrolujícího sami ověřte. Zkušenosti uživatelů mohou tento přístup podnítit, nedokazují však, že je spolehlivější nebo úspornější.
Mezi Claude Code a Codexem je lepší vybírat na základě vlastního testu, ne hlasování nebo jediného příběhu o přechodu. Vyzkoušejte oba nástroje na vlastních úkolech, v potřebném prostředí a s ohledem na skutečné limity tarifu. Takový test nedá univerzální odpověď pro všechny týmy, ale pomůže zjistit, která možnost vyhovuje vašemu pracovnímu postupu.