Erfahrungsbasiert: Open-Source-Modell-Gateway mit intelligentem Routing
Experiential ist ein neues Open-Source-Modell-Gateway von experientiallabs, das eine einheitliche OpenAI-kompatible API für gehostete, BYOK (bring-your-own-key) und lokale Modelle bereitstellt. Das in Rust implementierte Gateway fügt weniger als 1ms für BYOK-Anfragen und weniger als 2ms hinzu, wenn Experiential den Provider-Schlüssel bereitstellt, und wird mit jedem großen Inferenzanbieter und über 1000 Modellen geliefert, die täglich über einen Codex-Agenten aktualisiert werden, der einen PR eröffnet.
Hauptfunktionen
- Eine Steuerungsebene für geschlossene, Open-Source-, lokale und benutzerdefinierte Modelle – kombinieren Sie sie nach Bedarf.
- Kein Aufschlag: Im Gegensatz zu anderen Routern, die 10% Token-Gebühren verlangen, erhebt Experiential keinen Aufschlag auf ihr gehostetes Gateway, und der Quellcode ist für Self-Hosting vollständig offen.
- Optimierung auf Basis des Datenverkehrs (optional): Es verwendet standardisierte OpenTelemetry-Traces, um einen Router zu erstellen, der das optimale Modell pro Anfrage basierend auf Kosten/Qualität auswählt.
- Text-Weltmodelle simulieren Rollouts für verschiedene Modelle, ein LLM-Judge bewertet sie, und ein Nächste-Nachbarn-Klassifikator auf Prompt-Embeddings entscheidet, welches Modell aufgerufen wird.
- Cache-Optimierung und neue Modellvorschläge entstehen aus derselben Simulationspipeline.
- Budgetkontrollen pro Benutzer, Agent und Anwendungsfall.
Erste Schritte
Installieren und starten Sie das lokale Gateway:
pip install experiential
Beim ersten Start verbindet der Setup-Assistent die Anbieter und weist einen einmaligen Schlüssel zu. Dann können Sie jedes Modell über das Gateway aufrufen:
export EXP_GATEWAY_KEY=...
curl http://127.0.0.1:8000/v1/chat/completions \
-H "Authorization: Bearer $EXP_GATEWAY_KEY" \
-H 'Content-Type: application/json' \
-d '{"model":"opus-5","messages":[{"role":"user","content":"Help me"}]}'
Optimierung mit Ihrem Datenverkehr
So erstellen Sie einen benutzerdefinierten Router aus Ihren vorhandenen OTel-Traces:
exp build support-agent
Dieser Befehl führt Sie durch Anbieter, Modelle, Budget und fragt nach Ihrer Trace-Datei. Sie können auch ein Open-Source-Modell aus gesammelten Traces mit exp optimize model support-agent feinabstimmen. Wenn Sie es einfach ausprobieren möchten, laden Sie den öffentlichen Terminal-Tasks-Datensatz herunter:
curl -L -o traces.otel.jsonl https://huggingface.co/datasets/experiential-labs/wmo-terminal-tasks-traces/resolve/540883e451dc13d34fb50fdd36b143cb0f1fb0db/traces.otel.jsonl
Das Projekt wird aktiv weiterentwickelt (450 Commits, 655 Sterne) und enthält eine AGENTS.md für Repository-Konventionen. Telemetrie ist anonym und kann über exp config telemetry disable deaktiviert werden.
Experiential positioniert sich als direkte Alternative zu proprietären Gateways wie OpenRouter, mit dem Versprechen, dass einfaches Routing keinen 10% Token-Aufschlag rechtfertigt. Es ist eine Option, die es wert ist, evaluiert zu werden, wenn Sie pro Token Gebühren bei einem kommerziellen Router zahlen oder mehrere Provider-SDKs jonglieren.
📖 Lesen Sie die vollständige Quelle: HN AI Agents
👀 Siehe auch

Alibis monatlicher 10-Dollar-Codierplan bietet OpenClaw-Nutzern umfangreichen Zugang zu mehreren KI-Modellen.
Für 10 US-Dollar pro Monat bietet Alibabas Plan Zugang zu den Modellen Qwen3.5-Plus, Kimi-K2.5, GLM-5 und MiniMax-M2.5 mit Kontingenten von 1.200 Anfragen pro 5 Stunden, 9.000 pro Woche und 18.000 pro Monat.
Aufbau einer Jarvis-ähnlichen KI mit MCP und offenen Modellen
Ein Entwickler baute einen persönlichen KI-Assistenten mit MCP und offenen Modellen wie Qwen3-Coder 480B, mit autonomer Dateibearbeitung, persistentem Kontext und hybridem lokalen/Cloud-Inferenz.

Schwarzes LLAB: Open-Source-Architektur für dynamisches Modell-Routing und Docker-isolierte KI-Agenten
Ein Entwickler hat Black LLAB als Open-Source-Projekt veröffentlicht, ein System, das Mistral 3B nutzt, um Anfragen zwischen lokalen und Cloud-Modellen zu routen und KI-Agenten in isolierten Docker-Containern mit OpenClaw-Integration auszuführt.

Zora: Offline-First KI-Agent mit Default-Deny-Sicherheit und lokalem Speicher
Zora ist ein KI-Agent, der standardmäßig vollständig offline über Ollama läuft, mit null Zugriffsberechtigungen startet und eine persistente Erinnerung über Sitzungen hinweg beibehält. Er adressiert Sicherheits- und Kostenprobleme, die bei anderen Agenten beobachtet wurden.