Deja de preguntar qué modelo de IA usar: enruta tareas a los niveles Haiku, Soneto y Opus

El usuario de Reddit u/spencer_kw critica las publicaciones diarias de "¿qué modelo debería usar?" y ofrece una respuesta concreta basada en un mes de enrutamiento por tipo de tarea. La idea clave: ningún modelo es óptimo para todo, y deberías enrutar las tareas al menos en tres niveles.
Niveles de Modelo por Tarea
- Leer archivos, resumir, responder preguntas de código: Usa el modelo más barato — Haiku, Qwen 3.6 via Ollama, Gemma 4. Enviar lecturas de archivos a Opus es quemar dinero.
- Escribir código, pruebas, plantillas: Nivel Sonnet — GPT-5.5 mini, DeepSeek v4. Generación sólida a una fracción del costo de los modelos avanzados.
- Refactorizaciones de múltiples archivos, arquitectura, depuración asíncrona compleja: Solo aquí necesitas Opus o GPT-5.5. Esto es ~15-20% de tu día.
Configuración Práctica de Enrutamiento
La distribución actual de u/spencer_kw:
- ~40% de las tareas → nivel Haiku (lectores baratos)
- ~35% → nivel Sonnet (generación)
- ~25% → nivel Opus (razonamiento complejo)
Gasto mensual total: $30–40 dependiendo de la carga de trabajo.
El enfoque de "conductor diario" está quebrado — pedir un solo modelo para todo es como pedir un solo vehículo que sirva tanto para carga como para ir al trabajo. Usa múltiples modelos y enruta según la tarea.
📖 Lee la fuente completa: r/openclaw
👀 Ver también

Cómo construir un sistema financiero local de datos + IA personal en Mac Studio
Un desarrollador comparte su experiencia construyendo un sistema completamente localizado de procesamiento de datos financieros y asistente de IA personal en un Mac Studio, incluyendo decisiones de arquitectura, división de memoria, orquestación con cron y optimizaciones iniciales.

Optimización de la Configuración de OpenClaw: Patrones e Ideas Prácticas
Los usuarios de OpenClaw comparten patrones de configuración efectivos, como el uso de cron para tareas programadas y la creación de subagentes especializados, para mejorar la funcionalidad y la eficiencia de costos.

Resolviendo el error "write_file no encontrado" en Gemini CLI para OpenClaw: Se requieren dos correcciones
Los agentes de OpenClaw que usan google-gemini-cli no pueden escribir archivos (write_file / default_api_write_file ausentes) debido a un tools.profile incorrecto y la falta de la bandera --approval-mode auto_edit en el subproceso. Solución: establecer el perfil en full e inyectar la bandera mediante la configuración cliBackends.

Guía: Ejecutar GitHub Copilot con un LLM Local en Windows a través del Servidor Lemonade
Un desarrollador creó una guía paso a paso para configurar GitHub Copilot para que funcione con un LLM local en un Framework Desktop usando Lemonade Server, abordando la falta de instrucciones simples para esta configuración en Windows.