pxpipe: Token-Nutzung von Claude Code um 60% senken, indem Kontext als Bilder dargestellt wird

✍️ OpenClawRadar📅 Veröffentlicht: 4. Juli 2026🔗 Source
pxpipe: Token-Nutzung von Claude Code um 60% senken, indem Kontext als Bilder dargestellt wird
Ad

pxpipe ist ein lokaler Proxy, der eine Preislücke ausnutzt: KI-Modelle berechnen Bilder nach Pixelmaßen, nicht nach eingebetteter Textdichte. Für umfangreichen Kontext wie System-Prompts, Tool-Dokumentation und Verlauf bedeutet dies ca. 3,1 Zeichen pro Bild-Token gegenüber ca. 1 Zeichen pro Text-Token bei echtem Claude-Code-Verkehr. Das Ergebnis ist eine Kostensenkung um ~59–70% (Listenpreise) und eine Reduzierung um ~72–74% bei komprimierten Anfragen, wobei die primäre Kennzahl die Reduzierung der Eingabe-Tokens ist – z. B. ~25.000 Text-Tokens, die als ~2.700 Bild-Tokens gerendert werden.

Funktionsweise

pxpipe läuft als lokaler Proxy, der Anfragen von Claude Code/Gateway abfängt. Es schreibt die umfangreichen Teile (System-Prompt, Tool-Dokumentation, älterer Verlauf) vor dem Verlassen des Rechners in kompakte PNG-Bilder um. Der Proxy enthält auch ein OCR-Anweisungsbanner, das überlagert wird, damit das Modell den Text zuverlässig lesen kann. Fable 5 erreicht eine Lese-Genauigkeit von 100/100 in einer sauberen Auswertung. Opus 4.8 hat Schwierigkeiten mit dichten Bildinhalten (exakte Werte sollten Text bleiben).

Erste Schritte

npx pxpipe-proxy
# Proxy auf 127.0.0.1:47821
ANTHROPIC_BASE_URL=http://localhost:47821 claude

Öffnen Sie http://127.0.0.1:47821/ für ein Live-Dashboard mit gesparten Tokens, Sitzungsstatistiken und jeder Text→Bild-Konvertierung nebeneinander.

Ad

Wichtige Ergebnisse

  • Token-Reduzierung: Dichter Inhalt komprimiert ~10x (25.000 Text → 2.700 Bild-Token)
  • Kosteneinsparungen: 59–70% niedrigere Rechnung bei typischem Claude-Code-Verkehr, 72–74% bei komprimierten Anfragen
  • Genauigkeit: Fable 5 Modell liest Bilder mit 100/100 in sauberer Auswertung; Opus 4.8 ist verlustbehaftet für exakte Werte
  • Demo-Vergleich: Sitzungssummen: normal 42,21 $ (Kontext 96% voll) vs. pxpipe 6,06 $ (Kontext 7,4% voll)

Einschränkungen

Kleine oder wenige Anfragen profitieren nicht. Opus 4.8 kann exakte Werte aus Bildern nicht zuverlässig lesen (z. B. Phrasenzahlen). Die Einhaltung des Antwortformats bei Einzelantworten hat kleinere Unschärfen (eine Nachfrage kann nötig sein).

Für wen es geeignet ist

Entwickler, die Claude Code mit großen System-Prompts, umfangreicher Tool-Dokumentation oder langen Gesprächsverläufen verwenden – insbesondere in Fable 5 Umgebungen.

📖 Vollständige Quelle lesen: HN AI Agents

Ad

👀 Siehe auch

Weejur: Eine einfache Benutzeroberfläche für die Veröffentlichung auf GitHub Pages
Werkzeuge

Weejur: Eine einfache Benutzeroberfläche für die Veröffentlichung auf GitHub Pages

Weejur ist ein kostenloses Tool, das eine vereinfachte Benutzeroberfläche für die Veröffentlichung von Websites über GitHub Pages bietet und es Nutzern ermöglicht, nach der OAuth-Anmeldung HTML einzufügen oder Dateien hochzuladen.

OpenClawRadar
Alibis monatlicher 10-Dollar-Codierplan bietet OpenClaw-Nutzern umfangreichen Zugang zu mehreren KI-Modellen.
Werkzeuge

Alibis monatlicher 10-Dollar-Codierplan bietet OpenClaw-Nutzern umfangreichen Zugang zu mehreren KI-Modellen.

Für 10 US-Dollar pro Monat bietet Alibabas Plan Zugang zu den Modellen Qwen3.5-Plus, Kimi-K2.5, GLM-5 und MiniMax-M2.5 mit Kontingenten von 1.200 Anfragen pro 5 Stunden, 9.000 pro Woche und 18.000 pro Monat.

OpenClawRadar
OpenClaw-superpowers fügt Zuverlässigkeitsfunktionen für betriebliche Ausfallmodi hinzu
Werkzeuge

OpenClaw-superpowers fügt Zuverlässigkeitsfunktionen für betriebliche Ausfallmodi hinzu

Das openclaw-superpowers-Repository wurde um acht neue, auf Zuverlässigkeit ausgerichtete Fähigkeiten erweitert, darunter Preflight-Checks für Bereitstellungen, Nachweis der Cron-Ausführung, Wiederherstellung nach Sitzungsrücksetzungen und MCP-Auth-Lebenszyklusverwaltung. Diese Ergänzungen erhöhen die Gesamtzahl auf 60 Fähigkeiten, wovon 44 OpenClaw-nativ sind und 23 für Cron-Planung konzipiert wurden.

OpenClawRadar
Aufbau eines sprachgesteuerten Multi-Agenten-Systems auf Basis von Claude Code
Werkzeuge

Aufbau eines sprachgesteuerten Multi-Agenten-Systems auf Basis von Claude Code

Ein Entwickler baute eine sprachgesteuerte Wake-Word-Schleife für Claude Code, die Unter-Agents spawnen, Arbeit parallelisieren und Ergebnisse automatisch einer Qualitätssicherung unterzieht. Vollständige technische Aufschlüsselung inklusive Sprecherverifizierung und PID-Watcher.

OpenClawRadar