📚 Rezumate video · simpluspv.eu Automatizări cu AI · Cursul de AI

100 Hours Testing Claude Code vs ChatGPT Codex (honest results)

Nate Herk | AI Automation ⏱ 26:34 Publicat: 26 mai 2026 Transcriere auto
▶ Deschide pe YouTube
⚠️ Transcrierea acestui video este generată automat (limba sursă: engleză), deci pot exista mici erori de transcriere. Rezumatul și capitolele de mai jos sunt în limba română.

Rezumat ≈470 cuvinte

Autorul compară timp de ~100 de ore Claude Code (Anthropic) și ChatGPT Codex (OpenAI), două agent-uri de codare cu formă foarte asemănătoare: ambele editează cod local, au aplicații desktop, extensii VS Code, CLI, suport MCP, același format de skills (markdown cu YAML front matter), marketplace de plugin-uri, hooks, sub-agenți și opțiune de delegare în cloud. Întrebarea reală nu mai e „ce funcție are unealta", ci „care îmi dă cel mai bun flux de lucru".

Ce face Claude Code mai bine: personalizare în profunzime — ~30 de evenimente de hooks (Codex ~6), sub-agenți cu auto-delegare (Codex spawnează sub-agenți doar la cerere explicită), comenzile /ultra plan și /ultra review (review multi-agent în cloud, 3 rulări gratuite pe Pro/Max), /loop pentru rulări programate/întreținere, channels (MCP care aduce Telegram/Discord/iMessage în sesiune), Claude agent SDK (Python/TypeScript) și auth enterprise (Bedrock, Vertex AI, Microsoft Foundry).

Ce face Codex mai bine: flux „unified shipping" construit nativ pe git work trees, browser încorporat în desktop app (comentarii vizuale pe pagină), computer use mai ascuțit (QA automat cu severitate/pași de reproducere), integrare @Codex pe GitHub PR, comanda /goal pentru obiective lungi (între timp lansată și în Claude Code) și acces la GPT Image 2 pentru generare de imagini (Anthropic nu are model de imagini). Filozofic, OpenAI permite folosirea abonamentului ChatGPT în unelte terțe (Open Claw, Hermes — endorsat de Sam Altman), pe când Anthropic interzice login-ul Claude în produse terțe neaprobate.

Prețuri: Claude Pro 20$, Max 5x 100$, Max 20x 200$; Codex inclus în ChatGPT free/plus/pro (până la 200$ ~nelimitat), cu promo 2x pe tierul de 100$. Context: Opus/Sonnet 1M tokeni, GPT din Codex ~256K. Codex consumă mult mai puțini output tokens, deci se atinge mai greu limita de sesiune.

Test live (3 prompturi: raport PDF, landing page, dashboard): Claude Code (Opus 4.7 high) a câștigat la front-end și design — dashboard în ~2 min (Codex ~8 min) cu 283K tokeni vs 1.64M, design mai îngrijit. Codex (GPT-5.5 high) a fost mai bun la raportul de cercetare (mai rapid, 2.8M vs 4.7M tokeni, spacing PDF mai bun) și mai rapid pe landing page. Codex scrie de 2–5x mai puțini output tokens.

Concluzie: nu există un câștigător absolut. Claude Code pentru front-end complex, planificare, brainstorming, workflow-uri custom și enterprise; Codex pentru research, documente structurate, shipping end-to-end, /goal, GitHub și imagini. Mulți planifică cu Claude și execută/revizuiesc cu Codex. Proiectele sunt portabile (fișiere în GitHub, CLAUDE.mdAGENTS.md), deci folosește unealta potrivită pentru sarcina din față.

Capitole

00:00 Intro: comeback-ul OpenAI și ce sunt cele două unelte

Premisa videoului: după ce OpenAI „a devenit mediocru" și lumea de coding a uitat-o datorită Claude Code, Codex pare acum să fi revenit puternic. Autorul a testat Codex o lună întreagă și răspunde la întrebarea „e Codex mai bun?" comparând pe funcții, preț și 3 cazuri concrete.

  • Claude Code = agentul de codare al Anthropic; primește o sarcină, planifică, deschide proiectul, editează fișiere, rulează comenzi, cere permisiuni. Disponibil în terminal, extensie VS Code, app desktop Mac/Windows și versiune web (research preview). Rulează Opus (cel mai inteligent), Sonnet sau Haiku. Foarte personalizabil — skills, hooks, sub-agenți.
  • Codex = agentul OpenAI (nu modelul vechi din 2021), sistem agentic complet. Terminal, desktop Mac/Windows, extensie VS Code (merge și cu Cursor), versiune cloud la chat.openai.com/codex. Modele: familia GPT, GPT-Codex și GPT-Codex-Spark (mai rapid, research preview pentru Pro). Vibe „unified shipping" — git work trees native, te duce de la cod la producție. Inclus în orice plan ChatGPT, inclusiv free.
02:44 Senzația diferită și cât de mult au în comun

Feeling subiectiv: Claude Code pare mai creativ, mai bun la brainstorming și la „a-ți spune că greșești"; Codex urmează mai bine instrucțiunile și e mai ascuțit la review de cod și găsirea de bug-uri/lacune.

Suprapunere mare pe care alte comparații o ignoră: ambele editează cod local, au app desktop, extensii VS Code, CLI, suport MCP, același format skills (markdown + YAML front matter într-un folder), marketplace de plugin-uri, delegare în cloud, hooks și sub-agenți. Concluzie: întrebarea devine „care îmi dă fluxul de lucru potrivit", nu „cine are funcția X".

04:04 Ce face Claude Code unic mai bine
  • Hooks: ~30 de evenimente (prompt trimis, tool rulat, sesiune pornită, task creat) vs ~6 la Codex — cca 5x mai multă granularitate pentru automatizări.
  • Sub-agenți cu auto-delegare: Claude poate porni singur planner / explorer / code reviewer; documentația Codex spune explicit că nu spawnează sub-agenți decât la cerere.
  • /ultra plan (faza de planificare trimisă într-o sesiune cloud, review în browser cu comentarii inline, apoi execuție în terminal) și /ultra review (review multi-agent în cloud cu findings reproduse; 3 rulări gratuite pe Pro/Max, apoi pe rulare).
  • /loop: prompt recurent pe program sau „maintenance mode" (rezolvă task-uri neterminate, comentarii pe PR, conflicte de merge) — ex. rulează un skill la fiecare 20 min.
  • Channels (MCP care aduce evenimente din Telegram/Discord/iMessage în sesiune — îți poți „scrie" agentului de pe telefon), Claude agent SDK (Python & TypeScript, același engine) și auth enterprise: Bedrock, Vertex AI, Microsoft Foundry — pe care Codex nu le are.
06:18 Ce face Codex unic mai bine
  • Work trees native + review/stage/commit/push din aceeași app desktop = pipeline complet de shipping într-o singură unealtă (Claude are work trees, dar Codex le face să pară mai native).
  • Browser în app: vezi munca livrată și lași comentarii vizuale direct pe pagină (Claude are „Claude in Chrome" ca extensie — capabilitate similară, dar Codex ține totul într-o fereastră).
  • Computer use / QA: „QA the app I just built" — Codex deschide aplicația, dă click, găsește bug-uri și le loghează cu severitate, expected vs actual, pași de reproducere și triage summary.
  • @Codex pe GitHub: îl menționezi într-un PR/issue și pornește un sandbox cloud, fără setup.
  • /goal (experimental, în spatele unui flag): definești un obiectiv cu o condiție de oprire verificabilă și Codex lucrează ore întregi până termină. (Update în video: între timp Claude Code a lansat și el /goal.)
  • GPT Image 2 integrat pentru generare de imagini (jocuri, mockup-uri, site-uri) — Anthropic nu are model de imagini, ar trebui o unealtă terță.
09:13 Divergența filozofică: harness-uri terțe

Unelte terțe ca Open Claw sau Hermes Agent (open source) au explodat fiindcă par proactive — au cron-uri native, heartbeats, pot folosi skills. Cu Open Claw te poți loga cu abonamentul ChatGPT și să-ți rutezi consumul Codex prin el, fără API key separat (mai scump).

Sam Altman a confirmat public pe 2 mai că poți folosi abonamentul ChatGPT în Open Claw — stanță foarte permisivă. Anthropic e opusul: documentația agent SDK spune că, fără aprobare prealabilă, nu permite developerilor terți să ofere login Claude.ai sau rate limits în produsele lor. Concluzie: dacă trăiești în unelte terțe, înclină spre ChatGPT Codex.

10:22 Prețuri, context window și limite de sesiune
  • Claude: Pro 20$/lună (include Claude Code), Max 5x 100$ (5x usage), Max 20x 200$ (20x). Pro e ok pentru joacă, dar pentru zilnic serios îți trebuie un plan Max.
  • Codex: inclus în ChatGPT free și plus (20$) până la Pro 200$ (practic nelimitat). Promo: tierul de 100$ dă 2x usage Codex până pe 31 mai — unul dintre cele mai bune raporturi valoare/preț din piață.
  • Context window: Opus/Sonnet în Claude Code = 1 milion tokeni; ultimul GPT din Codex ≈ 256.000 tokeni.
  • Limite: mulți se plâng că ating limitele Claude Code (sesiune/săptămânal) mai repede. Autorul confirmă: face mai multă muncă în Codex înainte de a atinge limita, fiindcă Codex consumă mult mai puțini output tokens. Merită abonament la ambele pentru tipuri diferite de muncă.
12:38 Testul live: 3 prompturi identice (output-urile vizuale)

Aceleași 3 prompturi date ambelor unelte în app-urile desktop: (1) raport de cercetare PDF cu branding (automatizări pentru SMB), (2) landing page (brandul Glido), (3) dashboard de analytics cu date inventate.

  • Raport PDF: Claude Code = 15 pagini, stil „povestit" cu bullet-uri, header curat, dar titlul greu de citit și spacing prost la început; top 3 = Zapier, Lindy, make.com. Codex = 9 pagini, stil tabelar consistent, spacing puțin „înghesuit", logo pătrat ciudat; top 3 = Zapier, Lindy, Relay. Ambele cu surse clickabile (web fetch/search nativ, fără API key).
  • Landing page: autorul preferă clar versiunea Claude Code — font mai puțin „vibe coded", microfon care pulsează, cursor care clipește, banner glisant, glow și iconuri. Codex a pus logo-ul sus (Claude l-a uitat — fix ușor). Per total, Claude câștigă.
  • Dashboard: Claude Code arată vizibil mai bine (dark mode, filtre de dată funcționale, hover mai îngrijit pe chart de venit); Codex e funcțional identic dar pare „mai ieftin". Ambele interactive (datele se schimbă la click, hover pe funnel).
16:28 Metrici: cost, viteză, tokeni

Setup: Codex cu GPT-5.5 high, Claude Code cu Opus-4.7 high (performanța depinde mult de modelul din spate).

  • Timp total (3 rulări): Codex ~26 min, Claude ~15 min. Claude a fost mai rapid în toate, deși tipic Codex e mai iute (outlier: dashboard Claude ~2 min vs Codex ~8 min).
  • Tokeni: total ~6M ambele, foarte apropiat. Dar output tokens: Claude mereu mai mulți (ex. 83–84K vs 18K; 80K vs 20K; 41K vs 16K) — de 2–5x mai mulți decât Codex. Output-ul costă mai mult ca input-ul, de aceea Claude a costat mai mult (billing API ~11$ vs 7$, deși ambii pe abonament).
  • Eficiență: pe graficul tokeni × secunde, Claude are 2 puncte excelente (exp. 2 și 3) plus un outlier bun (raportul); Codex e consistent, grupat la mijloc. Datele s-au extras cerând uneltei să-și citească fișierul JSONL de sesiune (timp, tokeni, cache reads).
21:00 Verdict: când folosești fiecare unealtă

Nu e o victorie clară pentru niciunul. Claude a câștigat front-end-ul (dashboard de ~4x mai rapid și ~6x mai eficient pe tokeni: 283K vs 1.64M; design mai polisat) fiindcă planifică strâns înainte de execuție. Codex a câștigat raportul de cercetare (mai rapid și mai eficient: 2.8M vs 4.7M tokeni) și a fost mai iute pe landing page, fiindcă „macină" mai multe iterații dar scrie output mai concis.

  • Alege Claude Code: front-end complex, calitate vizuală/design, planificare profundă, auto-delegare, workflow-uri custom (hooks/skills/channels), agent SDK, enterprise (Bedrock/Vertex). E mai creativ și mai bun ca partener de brainstorming — te contrazice când greșești.
  • Alege Codex: sarcini de research din web, documente structurate (PDF/rapoarte), shipping end-to-end (work trees + review), /goal pentru obiective lungi, @Codex pe PR-uri GitHub, generare de imagini. Execută și „ascultă" mai bine, mai ales pe proiecte lungi.
  • Mindset: mulți planifică/brainstorming cu Claude și aduc Codex pentru review/execuție. Proiectele sunt portabile (fișiere în GitHub; CLAUDE.mdAGENTS.md) — nu ești blocat într-o unealtă. Totul e valabil pentru mai-mijloc 2026; verifică docs-urile, fiindcă ambele se schimbă rapid.
Toate rezumatele · simpluspv.eu — automatizări cu AI și cursuri pentru firme.