RelayPlane Open Source Proxy zeigt 73 % Kostensenkung durch Claude-Modell-Routing

✍️ OpenClawRadar📅 Veröffentlicht: 7. April 2026🔗 Source
RelayPlane Open Source Proxy zeigt 73 % Kostensenkung durch Claude-Modell-Routing
Ad

Open-Source-Proxy für Claude-API-Routing

RelayPlane ist ein Open-Source-, npm-nativer Proxy, der vor der Anthropic API sitzt. Das Tool wurde mit Claude Code entwickelt, was die Entwicklung beschleunigte. Es ist kostenlos selbst zu hosten und dafür ausgelegt, das Routing zwischen verschiedenen Claude-Modellen basierend auf der Eingabeaufforderungskomplexität zu handhaben.

Benchmark-Ergebnisse und Konfiguration

Der Benchmark verwendete eine gemischte Arbeitslast mit 60 % einfachen und 40 % komplexen Aufgaben. Zwei Szenarien wurden verglichen:

  • Direkt (alle Sonnet): p50-Latenz 1,55 s, Kosten pro 10 Anfragen 0,0323 $
  • Über RelayPlane mit Routing: p50-Latenz 0,78 s, Kosten pro 10 Anfragen 0,0086 $

Dies entspricht einer Kostensenkung von 73,4 %. Bei 10.000 Anfragen pro Tag entspricht dies etwa 712 $ monatlicher Einsparungen.

Ad

Routing-Konfiguration

Die Routing-Konfiguration ist unkompliziert:

{
  "routing": {
    "complexity": {
      "enabled": true,
      "simple": "claude-haiku-4-5",
      "moderate": "claude-sonnet-4-6",
      "complex": "claude-opus-4-6"
    }
  }
}

Die Routing-Logik verwendet einen Komplexitätsklassifikator, der Tokenanzahl, Code-Indikatoren und analytische Schlüsselwörter prüft. Antwort-Header enthalten x-relayplane-routed-model, um zu überprüfen, welches Modell die Anfrage tatsächlich verarbeitet hat.

Modellpreise und Routing-Logik

Das Routing-System leitet Eingabeaufforderungen basierend auf der Komplexität an geeignete Modelle weiter:

  • Einfache Eingabeaufforderungen → Haiku (0,80 $ pro Million Token)
  • Mittlere Eingabeaufforderungen → Sonnet (3 $ pro Million Token)
  • Komplexe Eingabeaufforderungen → Opus (15 $ pro Million Token)

Der Autor merkt an, dass der Klassifikator nicht perfekt ist, aber "gut genug, um den größten Teil der Einsparungen zu erfassen". Die vollständige Benchmark-Methodik ist in einem Gist verfügbar, der im Quellmaterial verlinkt ist.

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

Mehr-Agenten-Debatten-App entwickelt mit Claude, ElevenLabs und Flux
Werkzeuge

Mehr-Agenten-Debatten-App entwickelt mit Claude, ElevenLabs und Flux

Ein Entwickler hat eine Debatten-App erstellt, in der Claude Argumente für zwei Personas zu jedem Thema generiert, mit einem KI-Richter, der bewertet und einen Gewinner auswählt. Die App fügt über ElevenLabs Stimmen und über Flux Bilder hinzu, um ein Debatten-Showerlebnis zu schaffen.

OpenClawRadar
Telegram-Bot zur CLI-Steuerung von Claude Code vom Mobilgerät aus
Werkzeuge

Telegram-Bot zur CLI-Steuerung von Claude Code vom Mobilgerät aus

Ein Entwickler hat einen Telegram-Bot erstellt, der eine Brücke zur Claude Code CLI schlägt und die Steuerung über mobile Befehle wie /commit, /code_review und /simplify ermöglicht. Der Bot entdeckt automatisch benutzerdefinierte Fähigkeiten, verarbeitet Fotos/Dokumente/Sprachnachrichten und unterstützt Gruppenchat-Sitzungen.

OpenClawRadar
Claude AI entwickelte in Stunden einen UFO-Datenvisualisierer mit Regierungsdaten
Werkzeuge

Claude AI entwickelte in Stunden einen UFO-Datenvisualisierer mit Regierungsdaten

Ein Reddit-Nutzer hat mit Claude AI einen Full-Stack-UFO-Sichtungs-Visualizer aus neu veröffentlichten Daten des US-Kriegsministeriums erstellt, der auf Cloudflare gehostet wird – und das in nur wenigen Stunden.

OpenClawRadar
Einführung von operate.txt: Eine YAML-Spezifikation für KI-Agenten zur Navigation von SaaS-Produkten
Werkzeuge

Einführung von operate.txt: Eine YAML-Spezifikation für KI-Agenten zur Navigation von SaaS-Produkten

Ein Entwickler hat operate.txt erstellt, eine YAML-Datei, die unter yourdomain.com/operate.txt gehostet wird und Bildschirmdetails, Ladezustände, irreversible Aktionen sowie schrittweise Pfade für KI-Agenten dokumentiert, die Computer-Nutzungsfunktionen verwenden. Die Spezifikation behandelt Probleme wie Claude, das bei legitimen Ladebildschirmen fragt: 'Ist das kaputt?'

OpenClawRadar