pxpipe: Token-Nutzung von Claude Code um 60% senken, indem Kontext als Bilder dargestellt wird

pxpipe ist ein lokaler Proxy, der eine Preislücke ausnutzt: KI-Modelle berechnen Bilder nach Pixelmaßen, nicht nach eingebetteter Textdichte. Für umfangreichen Kontext wie System-Prompts, Tool-Dokumentation und Verlauf bedeutet dies ca. 3,1 Zeichen pro Bild-Token gegenüber ca. 1 Zeichen pro Text-Token bei echtem Claude-Code-Verkehr. Das Ergebnis ist eine Kostensenkung um ~59–70% (Listenpreise) und eine Reduzierung um ~72–74% bei komprimierten Anfragen, wobei die primäre Kennzahl die Reduzierung der Eingabe-Tokens ist – z. B. ~25.000 Text-Tokens, die als ~2.700 Bild-Tokens gerendert werden.
Funktionsweise
pxpipe läuft als lokaler Proxy, der Anfragen von Claude Code/Gateway abfängt. Es schreibt die umfangreichen Teile (System-Prompt, Tool-Dokumentation, älterer Verlauf) vor dem Verlassen des Rechners in kompakte PNG-Bilder um. Der Proxy enthält auch ein OCR-Anweisungsbanner, das überlagert wird, damit das Modell den Text zuverlässig lesen kann. Fable 5 erreicht eine Lese-Genauigkeit von 100/100 in einer sauberen Auswertung. Opus 4.8 hat Schwierigkeiten mit dichten Bildinhalten (exakte Werte sollten Text bleiben).
Erste Schritte
npx pxpipe-proxy
# Proxy auf 127.0.0.1:47821
ANTHROPIC_BASE_URL=http://localhost:47821 claude
Öffnen Sie http://127.0.0.1:47821/ für ein Live-Dashboard mit gesparten Tokens, Sitzungsstatistiken und jeder Text→Bild-Konvertierung nebeneinander.
Wichtige Ergebnisse
- Token-Reduzierung: Dichter Inhalt komprimiert ~10x (25.000 Text → 2.700 Bild-Token)
- Kosteneinsparungen: 59–70% niedrigere Rechnung bei typischem Claude-Code-Verkehr, 72–74% bei komprimierten Anfragen
- Genauigkeit: Fable 5 Modell liest Bilder mit 100/100 in sauberer Auswertung; Opus 4.8 ist verlustbehaftet für exakte Werte
- Demo-Vergleich: Sitzungssummen: normal 42,21 $ (Kontext 96% voll) vs. pxpipe 6,06 $ (Kontext 7,4% voll)
Einschränkungen
Kleine oder wenige Anfragen profitieren nicht. Opus 4.8 kann exakte Werte aus Bildern nicht zuverlässig lesen (z. B. Phrasenzahlen). Die Einhaltung des Antwortformats bei Einzelantworten hat kleinere Unschärfen (eine Nachfrage kann nötig sein).
Für wen es geeignet ist
Entwickler, die Claude Code mit großen System-Prompts, umfangreicher Tool-Dokumentation oder langen Gesprächsverläufen verwenden – insbesondere in Fable 5 Umgebungen.
📖 Vollständige Quelle lesen: HN AI Agents
👀 Siehe auch

KI-Klaue: Serverless-Brücke verbindet Alexa mit lokaler OpenClaw mit dualer Auslieferung
AI Claw ist eine Python AWS Lambda-Pipeline, die Amazon Echo-Lautsprecher mit lokalen OpenClaw-Instanzen verbindet und Amazons 8-Sekunden-Timeout umgeht, indem sie eine Fire-and-Forget-Architektur mit dualer Zustellung an Telegram und native Echo-Audioausgabe verwendet.

PromptFlow Voice: Hindi sprechen, strukturierte Claude-Code-Aufforderungen erhalten – erstellt mit Claude Code
Ein Entwickler nutzte Claude Code und Codex, um PromptFlow Voice zu entwickeln – eine Desktop-App, die gesprochenes Hindi in strukturierte Entwickler-Prompts für Claude Code oder versandfertige E-Mails für Gmail umwandelt. Die Demo zeigt eine Hindi-Sprachanfrage, die einen englischen Claude Code-Prompt zur Socket-Wiederverbindungslogik mit exponentiellem Backoff erzeugt.

Entwickler testet Apple Intelligence für Aufgaben mit der Zwischenablage auf dem Gerät
Ein Entwickler baute einen Zwischenablage-Manager mit dem Foundation Models Framework von Apple Intelligence und fand es für alltägliche Aufgaben wie kurze Zusammenfassungen und Umarbeitungen angemessen, jedoch bei mehrdeutiger Sprache und detaillierter Arbeit eingeschränkt.

Kostenlose Version von Karpathys Coding-Skills neu geschrieben, schaltet Claude Coding-Disziplin ohne Pro frei
Ein Reddit-Nutzer hat Karpathys Programmierdisziplin-Richtlinien für den kostenlosen Plan von Claude umgeschrieben und dabei Terminal- und Subagent-Abhängigkeiten entfernt. Der System-Prompt löst sich automatisch bei Programmieranfragen aus und erzwingt ein verifikationsorientiertes Denken.