Claude Code vs Codex: 36 vs 28 arquivos, $2,50 vs $2,04, loop infinito detectado — comparação no mundo real
Alguém no r/ClaudeAI fez uma comparação direta entre Claude Code e Codex (via Cursor) em duas tarefas práticas — mesmos prompts, mesma configuração MCP (GitHub + Slack), mesma máquina. Sem benchmarks, construções reais.
Tarefas
- Tarefa 1: Bot de triagem de PR — Ler PRs abertos, pontuar por complexidade (arquivos ×2, linhas/10, +3 se sem labels, +5 se sem revisores), escrever relatório em markdown, enviar alertas no Slack para pontuações altas. Exigiu retentativas, registro de erros, TypeScript estrito, sem
any. - Tarefa 2: Interface de revisão de código em tempo real — React + TypeScript, WebSockets, threads de comentários inline, atualizações otimistas com rollback, visualizador de diff virtualizado, reconexão WS com backoff exponencial. Sem bibliotecas de UI.
Resultados do Claude Code
- Executou
/mcppara verificar ferramentas antes de escrever código - Construiu 36 arquivos em ~12 minutos
- Escreveu um teste de smoke WebSocket com dois clientes não solicitado (broadcast: 3ms)
- Zero
any, passou na verificação de tipos na primeira tentativa - UI funcionou imediatamente
Resultados do Codex (via Cursor)
- Falhou na Tarefa 1: O MCP do GitHub não estava acessível através do caminho de execução do Cursor. Lidou com isso de forma limpa (repetiu 3 vezes, registrou erros, não travou), mas sem entrega.
- Tarefa 2: Entregou uma UI funcional em ~15 minutos, teste de smoke passou em 5ms
- Encontrou erros TypeScript na primeira compilação e um loop infinito no React (
useEffectchamando hydrate repetidamente). Precisou de um patch de guarda de referência. - 28 arquivos, arquitetura mais compacta
Custo (estimado, ambas as tarefas)
- Claude: ~$2,50
- Codex: ~$2,04
- Diferença: ~18-23%
Conclusões
Nenhum agente "venceu". Claude parece trabalhar com alguém que verifica tudo antes de tocar no teclado. Codex parece um dev sênior que quer entregar e seguir em frente. Ambos conseguiram broadcast WebSocket abaixo de 10ms — seis meses atrás isso não era garantido. Sem vazamentos de any, sem nomes de ferramentas alucinados.
📖 Leia a fonte original: r/ClaudeAI
👀 See Also

Tokens do Repositório: Ação do GitHub Adiciona Emblema de Contagem de Tokens para Consciência da Janela de Contexto de LLM
Repo Tokens é uma GitHub Action que conta o tamanho da sua base de código em tokens usando tiktoken e exibe um emblema no seu README mostrando qual porcentagem da janela de contexto de um LLM ela preenche. O emblema usa verde para menos de 30%, amarelo para 50-70% e vermelho para 70%+.

O ViralCanvas.ai oferece um espaço de trabalho de contexto persistente para os modelos Claude, incluindo o Sonnet 4.5.
ViralCanvas.ai é um espaço de trabalho visual que funciona sobre os modelos da Claude, oferecendo acesso ao Sonnet 4.5, Sonnet 4.6, Opus 4.5 e Opus 4.6 com anexação de contexto persistente. A ferramenta aborda problemas de degradação de contexto em conversas longas mantendo documentos conectados ativamente ponderados em cada prompt.

Apfel: Ferramenta CLI Gratuita para Acessar o LLM Local da Apple no macOS
Apfel v0.6.13 é um binário Swift 6.3 que expõe o LLM integrado da Apple como uma ferramenta CLI, servidor compatível com OpenAI e chat interativo. Ele roda 100% no dispositivo, sem chaves de API ou custos, usando o modelo de 4.096 tokens incluído no macOS 26+ em Macs com Apple Silicon.

Comparando Sistemas de IA Multiagente: Harness da Anthropic vs Modelo de Engenharia Organizacional da Agyn
A Anthropic publicou um design de estrutura para desenvolvimento de aplicações de longa duração, enquanto o sistema multiagente Agyn para engenharia de software autônoma baseada em equipe foi disponibilizado em código aberto no mês passado. Ambos os sistemas rejeitam agentes monolíticos em favor de separação de papéis, transferências estruturadas e ciclos de revisão.