Orkestra: Capa de Enrutamiento de LLM Consciente de Costos para OpenClaw Reduce los Costos de API en un 60-80%

Qué hace Orkestra
Orkestra es una capa de enrutamiento LLM consciente de los costos, creada para OpenClaw, que reduce los costos de API en un 60-80%. Es una arquitectura modular que se sitúa frente a las llamadas de modelo y decide qué nivel debe manejar cada solicitud según la similitud semántica.
Cómo funciona
Cuando llega una solicitud, se incrusta y pasa por un clasificador KNN ligero entrenado con cargas de trabajo previamente etiquetadas. Según la similitud semántica, el enrutador la categoriza como budget, balanced o premium y reenvía la llamada en consecuencia.
No hay reescritura de solicitudes ni árbol de reglas complejo, solo clasificación semántica en el momento de la llamada. La reducción en los costos de API proviene principalmente de evitar que las solicitudes más simples recurran por defecto a los modelos más costosos.
Integración con OpenClaw
Orkestra se conecta como una habilidad de OpenClaw a través de un proxy local, por lo que las canalizaciones existentes permanecen completamente intactas. El agente la llama mediante bash/curl a un endpoint compatible con OpenAI en 127.0.0.1:8765.
La respuesta incluye transparencia total de costos con los campos _orkestra.cost y _orkestra.savings_percent.
Proveedores admitidos y configuración
- Proveedores admitidos: Google (Gemini), Anthropic (Claude), OpenAI
- Enruta entre niveles económicos/equilibrados/premium dentro de cada proveedor
- Admite modo multi-proveedor en los tres proveedores
- Repositorio e integración con OpenClaw disponibles en: github.com/imperativelabs/orkestra
- Consulta
integrations/openclaw/para los archivos de habilidad, proxy y ejemplos de configuración
📖 Read the full source: r/openclaw
👀 Ver también

ClawClone: Herramienta de Copia de Seguridad en la Nube para Espacios de Trabajo de OpenClaw
ClawClone es una herramienta que respalda los espacios de trabajo de OpenClaw en la nube con un solo comando y los restaura con otro. Fue creada después de que un desarrollador perdiera un mes de datos de entrenamiento.

Habilidad de Código Claude /consejo Ejecuta Prompts en Paralelo en 4 Modelos de IA
Una habilidad de Claude Code llamada /council envía cualquier indicación a GPT, Claude, Gemini y Grok simultáneamente en unos 7 segundos, luego utiliza Gemini para sintetizar la mejor respuesta identificando mejoras específicas de los otros modelos.

Cómo Mover o Renombrar Carpetas de Proyectos de Código Claude Sin Perder el Historial de Sesión
Claude Code almacena el historial de sesiones utilizando rutas de proyecto absolutas, por lo que mover o renombrar carpetas con mv interrumpe el acceso a las sesiones. La herramienta clamp soluciona esto migrando los datos de sesión para que coincidan con las nuevas rutas.

Modo Contexto del Servidor MCP Reduce el Uso de Código Contexto de Claude en un 98%
Context Mode es un servidor MCP que reduce el consumo de contexto de Claude Code de 315 KB a 5.4 KB aislando las salidas de herramientas. Es compatible con 10 entornos de ejecución de lenguajes e incluye una base de conocimiento con búsqueda de texto completo.