Orkestra: Kostenbewusste LLM-Routing-Schicht für OpenClaw reduziert API-Kosten um 60–80 %

Was Orkestra tut
Orkestra ist eine kostenbewusste LLM-Routing-Schicht für OpenClaw, die API-Kosten um 60-80 % reduziert. Es handelt sich um eine modulare Architektur, die vor Modellaufrufen sitzt und basierend auf semantischer Ähnlichkeit entscheidet, welche Stufe jede Anfrage bearbeiten soll.
Wie es funktioniert
Wenn ein Prompt eingeht, wird er eingebettet und durch einen leichten KNN-Klassifikator geleitet, der auf zuvor gelabelten Workloads trainiert wurde. Basierend auf semantischer Ähnlichkeit kategorisiert der Router ihn als budget, balanced oder premium und leitet den Aufruf entsprechend weiter.
Es gibt keine Prompt-Umschreibung und keinen komplexen Regelbaum – nur semantische Klassifizierung zum Zeitpunkt des Aufrufs. Die Reduzierung der API-Kosten kommt hauptsächlich dadurch zustande, dass einfachere Prompts nicht standardmäßig an die teuersten Modelle weitergeleitet werden.
Integration mit OpenClaw
Orkestra wird als OpenClaw-Skill über einen lokalen Proxy eingebunden, sodass bestehende Pipelines vollständig intakt bleiben. Der Agent ruft es über bash/curl an einen OpenAI-kompatiblen Endpunkt unter 127.0.0.1:8765 auf.
Die Antwort enthält vollständige Kostentransparenz mit den Feldern _orkestra.cost und _orkestra.savings_percent.
Unterstützte Anbieter und Konfiguration
- Unterstützte Anbieter: Google (Gemini), Anthropic (Claude), OpenAI
- Routing über Budget-/Balanced-/Premium-Stufen innerhalb jedes Anbieters
- Unterstützt Multi-Provider-Modus über alle drei Anbieter
- Repository und OpenClaw-Integration verfügbar unter: github.com/imperativelabs/orkestra
- Siehe
integrations/openclaw/für die Skill-Dateien, Proxy und Konfigurationsbeispiele
📖 Read the full source: r/openclaw
👀 Siehe auch

PromptForest: Lokale-First Eingabeinjektionsdetektion mit Unsicherheit
PromptForest ist eine leichtgewichtige, lokal zuerst gedachte Bibliothek, die Eingabeaufforderungsinjektionen und Jailbreaks erkennt und sie klassifiziert, während sie die Sicherheit bewertet, und das alles, ohne die durchschnittliche Anforderungslatenz zu erhöhen.

Sechs Open-Source-Tools, die die Sicherheits-, Kosten- und Komplexitätsprobleme von OpenClaw angehen
Ein Entwickler testete sechs Community-Tools, um die von Cisco aufgedeckten Sicherheitslücken von OpenClaw, die explodierenden Kosten und die komplexe Einrichtung zu lösen. ClawSec bietet Sicherheitsscans und Integritätsprüfungen, Antfarm ermöglicht deterministische Multi-Agenten-Workflows und LanceDB Pro verbessert den Speicherzugriff mit hybrider Vektorsuche.

Claude Code Auto-Modus: Eine sicherere Alternative zum Überspringen von Berechtigungen
Claude Code bietet jetzt den Automodus, einen Berechtigungsmodus, in dem Claude Berechtigungsentscheidungen trifft, während Sicherheitsvorkehrungen Aktionen vor der Ausführung überwachen. Er ist als Forschungsvorschau für Team-Plan-Nutzer verfügbar, mit einer Veröffentlichung für Enterprise und API in Kürze.

Sense: Go SDK für KI-gestützte Test-Assertions und strukturierte Textextraktion
Sense ist ein Go SDK, das Claude für zwei Hauptfunktionen nutzt: die Bewertung nicht-deterministischer Ausgaben in Tests mit einfachen englischen Assertions und die Extraktion typisierter Structs aus unstrukturiertem Text durch Reflection und erzwungene tool_use.