Usuários do OpenClaw Relatam Substituições de Modelos Após Proibição da Anthropic

Ranking da Comunidade e Preferências de Modelos
De acordo com as votações da comunidade registradas em pricepertoken.com/leaderboards/openclaw em 5 de abril (líquido = votos positivos menos votos negativos):
- Kimi K2.5 -- +49 líquido (54 positivos, 5 negativos). $0,38/M tokens de entrada. Suporte nativo ao OpenClaw adicionado. 13x mais barato que o Opus.
- GLM 4.7 -- +20 líquido (25 positivos, 5 negativos). $0,39/M entrada. Escolha econômica na nuvem.
- Gemini 3 Flash Preview -- +18 líquido (21 positivos, 3 negativos). Não é o Pro — a variante flash. Pessoas escolhendo velocidade + custo em vez de qualidade bruta.
- Claude Opus 4.5 -- +18 líquido, mas 32 positivos / 14 negativos. Mais votos no total, mas também o mais controverso. As pessoas estão divididas sobre pagar taxas de API por algo que costumava estar incluído.
- Claude Opus 4.6 -- +17 líquido (19 positivos, 2 negativos).
Substituto Mais Adotado: GPT-5.x
A OpenAI adicionou oficialmente suporte ao GPT-5.4 no OpenClaw e oferece 1 milhão de tokens gratuitos por dia no nível de compartilhamento de dados. As assinaturas do Codex permitem explicitamente o uso de ferramentas de terceiros.
A pilha completa de Matthew Berman agora é: GPT 5.3 Codex XH para codificação, GPT 5.2 como padrão, GPT 5 Mini para classificadores. Claude apenas como backup.
Opções de Modelos Locais
O consenso do r/LocalLLaMA inclui:
- Qwen 3.5 27B -- escolha principal. 72,4% no SWE-bench (equivalente ao GPT-5 mini). Zen van Riel executando a versão 35B a 100-140 tok/s em uma RTX 5090.
- Qwen3-Coder:32B -- "chamada de ferramentas extremamente estável"
- Llama 4 -- padrão para implantações locais de propósito geral
- Devstral-24B -- recomendado como principal com GLM-4.7 flash como fallback
O Ollama se tornou um provedor oficial do OpenClaw em março. Uma pessoa no X está executando Qwen 3.5 + OpenClaw + Ollama completamente de graça.
Configurações Híbridas e Considerações de Custo
As pessoas que parecem mais satisfeitas não estão apostando tudo em um único modelo. Elas estão executando pilhas em camadas:
- Modelo caro (Claude/GPT) para raciocínio complexo
- Modelo barato (DeepSeek a $0,14/M, Kimi, GLM) para operações rotineiras
Um usuário construiu um gateway Kubernetes em 5 Raspberry Pis roteando Claude, GPT, Gemini e DeepSeek por trás de uma única API.
@0xzak compartilhou uma configuração específica: DeepSeek para rotina ($0,14/$1,10) vs Sonnet para complexidade ($3/$15), contextTokens em 120k, não 150k.
Contornas e Ferramentas de Migração
O OpenClaw contornou a proibição do OAuth canalizando através do binário CLI local do Claude em vez de tokens OAuth. O próprio Pete recomendou esse método.
Oh-My-Codex (OmX) — uma camada de fluxo de trabalho/orquestração para o CLI Codex da OpenAI ganhou 13 mil estrelas na mesma semana da proibição.
Impacto e Mudanças de Custo
60% das sessões ativas do OpenClaw supostamente estavam rodando com créditos de assinatura antes da proibição.
O aumento de custo é brutal. Usuários pesados passaram de ~$200/mês fixos para ~$675/mês nas taxas de API. Algumas sessões automatizadas atingindo $1.000-$5.000/dia.
A Anthropic está oferecendo um crédito único + 30% em pacotes pré-pagos, mas o sentimento geral é de que é muito pouco.
📖 Leia a fonte completa: r/openclaw
👀 See Also

Plataforma Polsia Mostra Padrões Repetitivos de SaaS em Lançamentos ao Vivo de Fundadores
Polsia é uma plataforma de negócios autônoma onde os usuários descrevem seu negócio, pagam dinheiro, e ela executa autonomamente. Um cientista comportamental observou 72 horas de lançamentos ao vivo de fundadores, identificando padrões repetitivos como soluções de automação de SDR com IA e mercados internacionais subatendidos.

O ajuste fino do Phi-4-mini treinando apenas os parâmetros do LayerNorm não melhora o desempenho.
Um entusiasta testou o treinamento apenas dos valores γ do LayerNorm no Phi-4-mini em domínios de Python e medicina, com diferentes taxas de aprendizado e formatos de dados. O desempenho degradou ligeiramente em todos os benchmarks em comparação com a linha de base, com o autor concluindo que os transformadores já direcionam informações dinamicamente por meio da atenção.

OpenAI Codex OAuth retornando erros 429 desde 16 de março, apesar da cota estar completa
O OAuth do OpenAI Codex tem retornado consistentemente erros 429 "você excedeu sua cota atual" desde 16 de março, mesmo quando os painéis mostram 100% da cota restante. Usuários relatam que o problema persiste apesar da reautenticação, revogação de tokens e reconfiguração completa.

O Consumo de Energia da GPU Desvia-se da Teoria do Preditivo de Tokens em Pequenos LLMs
Um experimento testando a teoria do 'papagaio estocástico' em quatro modelos de 8 bilhões de parâmetros descobriu que o consumo de energia da GPU frequentemente escala de forma não linear com a contagem de tokens, com taxas de divergência variando de 7,7% a 36,7%. O estudo também revelou calor residual persistente após consultas filosóficas e efeitos dependentes da ordem.