Das WCY-Format reduziert den Token-Overhead von LLMs um 50–71 % und fügt strukturelle „Ich weiß nicht“-Marker hinzu.

✍️ OpenClawRadar📅 Veröffentlicht: 17. März 2026🔗 Source
Das WCY-Format reduziert den Token-Overhead von LLMs um 50–71 % und fügt strukturelle „Ich weiß nicht“-Marker hinzu.
Ad

WCY (Watch → Compute → Yield) ist ein zeilenorientiertes Format, das entwickelt wurde, um den LLM-Token-Overhead zu reduzieren und strukturelle Marker für Unsicherheit im Denkprozess bereitzustellen. Es ersetzt JSON-Klammern, Anführungszeichen und Kommas durch eine Ein-Marker-pro-Zeile-Syntax.

Token-Reduzierungs-Benchmarks

Aus Tests über 10-500 Zeilen und MCP-Austauschtypen:

  • Strukturierte Daten vs. JSON: -50 bis -54% Token-Reduzierung
  • Tool-Call-Schemas: -65 bis -71% Reduzierung
  • Vollständiger MCP-Protokollaustausch: -61% Reduzierung
  • Multi-Agent-Ausgabe-Tokens: -40% Reduzierung

Kein Fine-Tuning ist erforderlich – drei Few-Shot-Beispiele reichen aus, damit Modelle das Format wechseln. Die parse_r-Metrik geht von 0,29 auf 1,00 bei komplexen Aufgaben mit diesem Ansatz.

Ad

Der ?-Marker für Unsicherheit

WCY führt eine strukturelle Möglichkeit für LLMs ein, während des Denkprozesses zu markieren, was sie nicht wissen. Der ? (void-B)-Slot ermöglicht es Modellen, Unsicherheit inline anzuzeigen:

: ?diagnosis hint=labs+imaging conf_range=0.4..0.8
    order CT_scan reason=from=3 . CT_result mass_in_RUL size=2.3cm : diagnosis=adenocarcinoma conf=0.82 from=3,5

Tests zeigten:

  • Zero-Shot: Modelle verwenden ?-Marker 0% der Zeit, selbst mit der Spezifikation im Prompt
  • Mit 3 Beispielen: 5,4 Marker pro Trace, 67-97% gelöst
  • 48 Pipeline-Traces über 8 Domänen: 95% Auflösung, 100% Quality-Gate-Bestanden

Der from=-Slot verfolgt inline, welche Beobachtungen welche Schlussfolgerungen stützen, was hilft, Halluzinationsketten zu erkennen.

Verfügbare Ressourcen

  • wcy_parser.py – reines Python, keine externen Abhängigkeiten
  • wcy_eval.py – 3-Achsen-Bewertung (Strukturell / Bedeutung / Herkunft)
  • 60 Reasoning-Traces mit void-B-Zyklen (CC BY 4.0-Lizenz, für Fine-Tuning-Experimente)
  • Pipeline-Skript zum Generieren weiterer Traces

Bisher nur mit Claude Sonnet getestet. Der Autor ist neugierig, ob das 0% → 5,4 Marker-Ergebnis bei Qwen, Llama und Mistral mit denselben Few-Shot-Beispielen gilt.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

MCP-Kontextaufblähung: Echte Kosten und eine praktische Lösung für Claude-Code-Nutzer
Werkzeuge

MCP-Kontextaufblähung: Echte Kosten und eine praktische Lösung für Claude-Code-Nutzer

Der Betrieb von 9 MCP-Servern in Claude Code führt zu Kaltstarts mit 38k Token, ~700 $/Monat an Overhead durch Tool-Definitionen und verschlechterter Modellleistung. Ein Gateway-Muster mit BM25-Ranking reduziert den Kontext auf 4k.

OpenClawRadar
Claude DevTools: Ein Log-Reader für verbesserte Sichtbarkeit von Claude-Code
Werkzeuge

Claude DevTools: Ein Log-Reader für verbesserte Sichtbarkeit von Claude-Code

Claude DevTools ist ein lokales, Open-Source-Tool, das die bestehenden Protokolldateien von Claude Code in ~/.claude/ liest, um detaillierte Sichtbarkeit in Sitzungen zu bieten, einschließlich Dateioperationen mit Inline-Diffs, Token-Aufschlüsselungen, Visualisierung des Kontextfensters und vollständigen Ausführungsbäumen von Subagenten.

OpenClawRadar
Claude-File-Recovery: CLI-Tool extrahiert Dateien aus Claude-Code-Sitzungsverlauf
Werkzeuge

Claude-File-Recovery: CLI-Tool extrahiert Dateien aus Claude-Code-Sitzungsverlauf

claude-file-recovery ist ein Python-CLI-Tool und TUI, das JSONL-Sitzungstranskripte aus ~/.claude/projects/ analysiert, um Dateien wiederherzustellen, die von Claude Code erstellt, geändert oder gelesen wurden, einschließlich der punktgenauen Wiederherstellung früherer Dateiversionen.

OpenClawRadar
Claude Code schlägt still fehl, wenn ANTHROPIC_API_KEY in Cloud-Umgebungen gesetzt ist
Werkzeuge

Claude Code schlägt still fehl, wenn ANTHROPIC_API_KEY in Cloud-Umgebungen gesetzt ist

Das Setzen von ANTHROPIC_API_KEY in Cloud-Umgebungen führt zu Fehlfunktionen von Claude Code und kann unerwartete API-Nutzungskosten verursachen. Benutzer berichten von zusätzlicher Nutzung und nicht reagierendem Verhalten.

OpenClawRadar