Orkestra: Capa de Enrutamiento de LLM Consciente de Costos para OpenClaw Reduce los Costos de API en un 60-80%

Qué hace Orkestra
Orkestra es una capa de enrutamiento LLM consciente de los costos, creada para OpenClaw, que reduce los costos de API en un 60-80%. Es una arquitectura modular que se sitúa frente a las llamadas de modelo y decide qué nivel debe manejar cada solicitud según la similitud semántica.
Cómo funciona
Cuando llega una solicitud, se incrusta y pasa por un clasificador KNN ligero entrenado con cargas de trabajo previamente etiquetadas. Según la similitud semántica, el enrutador la categoriza como budget, balanced o premium y reenvía la llamada en consecuencia.
No hay reescritura de solicitudes ni árbol de reglas complejo, solo clasificación semántica en el momento de la llamada. La reducción en los costos de API proviene principalmente de evitar que las solicitudes más simples recurran por defecto a los modelos más costosos.
Integración con OpenClaw
Orkestra se conecta como una habilidad de OpenClaw a través de un proxy local, por lo que las canalizaciones existentes permanecen completamente intactas. El agente la llama mediante bash/curl a un endpoint compatible con OpenAI en 127.0.0.1:8765.
La respuesta incluye transparencia total de costos con los campos _orkestra.cost y _orkestra.savings_percent.
Proveedores admitidos y configuración
- Proveedores admitidos: Google (Gemini), Anthropic (Claude), OpenAI
- Enruta entre niveles económicos/equilibrados/premium dentro de cada proveedor
- Admite modo multi-proveedor en los tres proveedores
- Repositorio e integración con OpenClaw disponibles en: github.com/imperativelabs/orkestra
- Consulta
integrations/openclaw/para los archivos de habilidad, proxy y ejemplos de configuración
📖 Read the full source: r/openclaw
👀 Ver también

Terrarium: Caja de arena de código abierto para entornos agénticos con retroceso en el tiempo
Una solución de sandboxing versátil para ejecutar múltiples agentes de IA de forma segura en cualquier VPS o nube. Cuenta con mundos aislados, gestión de proxy inverso, interfaces gráficas y una máquina del tiempo para revertir el estado de los contenedores.

ai-codex: Pre-indexa tu base de código para ahorrar tokens de Claude
ai-codex es una herramienta que genera índices compactos en markdown de tu base de código, permitiendo que Claude Code omita la fase de exploración inicial que normalmente consume 30-50K tokens por conversación. Crea cinco archivos que cubren rutas, páginas, bibliotecas, esquemas y componentes.

Phaselock: Un Sistema de Control de Agentes de IA Inspirado en Técnicas de Crianza
Phaselock es una habilidad de agente de código abierto que implementa cuatro mecanismos de control para agentes de IA: compuertas explícitas antes de la acción, retroalimentación inmediata sobre errores, opciones restringidas y aplicación mecánica de reglas. Funciona con Claude Code, Cursor, Windsurf y herramientas que admiten hooks.
Agente IA OpenClaw con 6 Roles, Memoria y Diseño Consciente del TDAH: Desglose de Operaciones Diarias
Un fundador solitario con TDAH construyó un agente de IA de código abierto con 6 roles (planificador de acciones, coordinador de informes, redactor, legal, investigador, CRM) que comparten memoria, generando automáticamente seguimientos y borradores a partir de transcripciones.