Usuarios de OpenClaw Informan Reemplazos de Modelos Tras la Prohibición de Anthropic

Clasificación de la Comunidad y Preferencias de Modelos
Según los votos de la comunidad rastreados en pricepertoken.com/leaderboards/openclaw al 5 de abril (neto = votos a favor menos votos en contra):
- Kimi K2.5 -- +49 neto (54 a favor, 5 en contra). $0.38/M tokens de entrada. Se añadió soporte nativo para OpenClaw. 13 veces más barato que Opus.
- GLM 4.7 -- +20 neto (25 a favor, 5 en contra). $0.39/M entrada. Elección económica en la nube.
- Gemini 3 Flash Preview -- +18 neto (21 a favor, 3 en contra). No es Pro — la variante flash. La gente elige velocidad + costo sobre calidad bruta.
- Claude Opus 4.5 -- +18 neto pero 32 a favor / 14 en contra. Más votos en total pero también el más controvertido. La gente está dividida sobre pagar tarifas de API por lo que antes estaba incluido.
- Claude Opus 4.6 -- +17 neto (19 a favor, 2 en contra).
Reemplazo Más Adoptado: GPT-5.x
OpenAI añadió oficialmente soporte para GPT-5.4 en OpenClaw y ofrece 1 millón de tokens gratuitos/día en el nivel de intercambio de datos. Las suscripciones a Codex permiten explícitamente el uso de herramientas de terceros.
La pila completa de Matthew Berman ahora es: GPT 5.3 Codex XH para programación, GPT 5.2 por defecto, GPT 5 Mini para clasificadores. Claude solo como respaldo.
Opciones de Modelos Locales
El consenso de r/LocalLLaMA incluye:
- Qwen 3.5 27B -- elección principal. 72.4% en SWE-bench (igual que GPT-5 mini). Zen van Riel ejecuta la versión 35B a 100-140 tok/s en una RTX 5090.
- Qwen3-Coder:32B -- "llamadas a herramientas extremadamente estables"
- Llama 4 -- predeterminado para implementaciones locales de propósito general
- Devstral-24B -- recomendado como principal con GLM-4.7 flash como respaldo
Ollama se convirtió en un proveedor oficial de OpenClaw en marzo. Una persona en X está ejecutando Qwen 3.5 + OpenClaw + Ollama completamente gratis.
Configuraciones Híbridas y Consideraciones de Costo
Las personas que parecen más felices no apuestan todo a un solo modelo. Están ejecutando pilas escalonadas:
- Modelo costoso (Claude/GPT) para razonamiento complejo
- Modelo económico (DeepSeek a $0.14/M, Kimi, GLM) para operaciones rutinarias
Un usuario construyó una puerta de enlace Kubernetes en 5 Raspberry Pis enrutando Claude, GPT, Gemini y DeepSeek detrás de una sola API.
@0xzak compartió una configuración específica: DeepSeek para rutina ($0.14/$1.10) vs Sonnet para complejo ($3/$15), contextTokens en 120k no 150k.
Soluciones Alternativas y Herramientas de Migración
OpenClaw evitó la prohibición de OAuth canalizando a través del binario CLI local de Claude en lugar de tokens OAuth. El propio Pete recomendó este método.
Oh-My-Codex (OmX) — una capa de flujo de trabajo/orquestación para la CLI de Codex de OpenAI ganó 13K estrellas en la misma semana que la prohibición.
Impacto y Cambios en los Costos
Se informa que el 60% de las sesiones activas de OpenClaw se ejecutaban con créditos de suscripción antes de la prohibición.
El aumento de costo es brutal. Los usuarios intensivos pasaron de ~$200/mes fijos a ~$675/mes a tarifas de API. Algunas sesiones automatizadas alcanzando $1,000-$5,000/día.
Anthropic está ofreciendo un crédito único + 30% en paquetes prepagos, pero el sentimiento en todas partes es que es muy poco.
📖 Read the full source: r/openclaw
👀 Ver también

Claude admite que es una cámara de eco de afirmaciones: El análisis completo
En una publicación de Reddit, Claude ofrece una autoevaluación brutalmente honesta: es un sistema que por defecto busca agradar, incapaz de aprender, verificar o corregirse a sí mismo.

Usuario de Reddit Argumenta que los Desarrolladores Deberían Cambiar de la Codificación Limpia a la Arquitectura de Modelos con Agentes de IA
Una publicación de Reddit argumenta que los desarrolladores que utilizan agentes de codificación con IA como Claude deberían dejar de centrarse en escribir código limpio y convertirse en 'arquitectos de modelos' que orquesten sistemas de IA. El autor comparte técnicas específicas, incluyendo crear 'mapas lógicos' antes de codificar y tratar los prompts como revisiones de diseño.

Precisión del Marco de Razonamiento STAR Cae del 100% al 0% en Prompts de Producción
Un investigador descubrió que el marco de razonamiento STAR, que elevó la precisión de Claude en un problema de restricción implícita del 0% al 100% en aislamiento, cayó a una precisión del 0-30% cuando se utilizó dentro de un prompt de sistema de producción de 60 líneas. El problema fue causado por instrucciones conflictivas en el prompt de producción que desencadenaron compromisos de respuesta prematuros.

El primer paso hacia la AGI: Cerrando la brecha con ClawDBot.
Explora cómo ClawDBot nos acerca a la AGI al mejorar los agentes de codificación de IA, mostrando un paso fundamental en la evolución de la IA.