Revisão do Desempenho do Modelo OpenClaw: Codex 5.3 Lidera, Modelos GLM Decepcionam

✍️ OpenClawRadar📅 Publicado: April 17, 2026🔗 Source
Revisão do Desempenho do Modelo OpenClaw: Codex 5.3 Lidera, Modelos GLM Decepcionam
Ad

Ranking de Desempenho dos Modelos para OpenClaw

Um desenvolvedor testou vários modelos de IA com o OpenClaw e compartilhou observações detalhadas de desempenho. Os testes abrangeram os modelos Codex, Google, Sonnet, Gemini, DeepSeek e GLM da Z.ai, focando na experiência prática de uso em vez de benchmarks.

Modelos com Melhor Desempenho

  • Codex 5.3 - Nota 9/10. O modelo favorito do desenvolvedor, provavelmente ajustado para o OpenClaw com recursos de agente de chat aprimorados. Ele compreende bem a intenção do usuário, fornece a saída desejada consistentemente e tem interrupções e bugs mínimos.
  • Sonnet 4.6 - Nota 8/10. Segundo favorito devido à velocidade e capacidade de resolução de problemas. Oferece experiência suficiente quando o Codex 5.3 não está disponível, adequado para uso diário.
  • DeepSeek 3.2 Agent - Nota 7/10. Claramente personalizado para o OpenClaw, parece trabalhar com um agente nativo. Não é tão forte em codificação quanto Sonnet, Opus ou Codex, mas uma alternativa sólida para uso diário. As taxas de API são observadas como potencialmente altas para uma alternativa chinesa.

Modelos de Nível Médio

  • Google 3.1 Pro (Baixo e Alto) - Nota 6/10. Testado com autenticação antigravity. Interação fraca com o OpenClaw, desempenho lento, não convincente para uso constante. Só seria considerado se Sonnet e Codex não estivessem disponíveis.
Ad

Desempenhos Decepcionantes

  • GLM 4.7 - Nota 5/10. Comercializado como alternativa ao Sonnet com taxas de API baratas e cota 3-4x maior que o Codex em contas pro. No entanto, ele constantemente trava, responde tarde e produz saída de comprimento inconsistente mesmo em tarefas simples como verificar e-mails. Queimou 1 milhão de tokens em uma nova sessão apenas para verificar 5 e-mails.
  • GLM 5 - Nota 5/10. Benchmarks afirmam competir com Opus e Codex 5.3, mas a experiência no OpenClaw não corresponde. Usa 2-3x mais tokens para as mesmas tarefas, responde tarde e fornece respostas de codificação no nível do Sonnet 4.5. Precisa de otimização específica para o OpenClaw. A principal vantagem é o preço.
  • Gemini 3 Flash - Nota 4/10. Apenas adequado para tarefas muito simples, não recomendado para uso sério.

O desenvolvedor observou que escolher o modelo certo é difícil devido a diferenças óbvias na experiência, possivelmente porque o OpenClaw não está otimizado ou há problemas de qualidade do modelo. Eles expressaram decepção com os modelos GLM, apesar de quererem diversificar além do Codex, esperando correções futuras.

📖 Read the full source: r/openclaw

Ad

👀 See Also

ClaudeDesk v4.2–4.3 apresenta Visualização de Equipes de Agentes e o Mecanismo Atlas de Repositório.
Tools

ClaudeDesk v4.2–4.3 apresenta Visualização de Equipes de Agentes e o Mecanismo Atlas de Repositório.

ClaudeDesk v4.2–4.3 oferece uma interface gráfica de desktop para gerenciar as Equipes de Agentes do Claude Code CLI e otimiza a configuração de sessões com o Repository Atlas Engine.

OpenClawRadar
Phaselock: Um Sistema de Controle de Agentes de IA Inspirado em Técnicas de Paisagem
Tools

Phaselock: Um Sistema de Controle de Agentes de IA Inspirado em Técnicas de Paisagem

Phaselock é uma Habilidade de Agente de código aberto que implementa quatro mecanismos de controle para agentes de IA: portas explícitas antes da ação, feedback imediato sobre erros, escolhas restritas e aplicação mecânica de regras. Funciona com Claude Code, Cursor, Windsurf e ferramentas que suportam hooks.

OpenClawRadar
TigrimOS v1.1.0 e Tiger CoWork v0.5.0 lançados com enxames de agentes remotos e governança configurável.
Tools

TigrimOS v1.1.0 e Tiger CoWork v0.5.0 lançados com enxames de agentes remotos e governança configurável.

TigrimOS v1.1.0 e Tiger CoWork v0.5.0 lançados hoje adicionam comunicação entre enxames em instâncias remotas e cinco protocolos de governança configuráveis. Ambos são auto-hospedados, gratuitos e de código aberto.

OpenClawRadar
Benchmark Mostra que Ferramenta CLI Reduz Custos de Tokens de Código do Claude em 32% por Meio de Navegação Estrutural
Tools

Benchmark Mostra que Ferramenta CLI Reduz Custos de Tokens de Código do Claude em 32% por Meio de Navegação Estrutural

Um desenvolvedor criou uma ferramenta CLI em Rust que dá aos agentes Claude Code comandos de navegação estrutural como 'mostre-me um resumo de 180 tokens desta classe de 6.000 tokens'. Benchmarking no Sonnet 4.6 em 54 execuções automatizadas mostrou 32% de custo menor por tarefa e 67% mais edições de código por sessão.

OpenClawRadar