Das WCY-Format reduziert den Token-Overhead von LLMs um 50–71 % und fügt strukturelle „Ich weiß nicht“-Marker hinzu.

✍️ OpenClawRadar📅 Veröffentlicht: 17. März 2026🔗 Source
Das WCY-Format reduziert den Token-Overhead von LLMs um 50–71 % und fügt strukturelle „Ich weiß nicht“-Marker hinzu.
Ad

WCY (Watch → Compute → Yield) ist ein zeilenorientiertes Format, das entwickelt wurde, um den LLM-Token-Overhead zu reduzieren und strukturelle Marker für Unsicherheit im Denkprozess bereitzustellen. Es ersetzt JSON-Klammern, Anführungszeichen und Kommas durch eine Ein-Marker-pro-Zeile-Syntax.

Token-Reduzierungs-Benchmarks

Aus Tests über 10-500 Zeilen und MCP-Austauschtypen:

  • Strukturierte Daten vs. JSON: -50 bis -54% Token-Reduzierung
  • Tool-Call-Schemas: -65 bis -71% Reduzierung
  • Vollständiger MCP-Protokollaustausch: -61% Reduzierung
  • Multi-Agent-Ausgabe-Tokens: -40% Reduzierung

Kein Fine-Tuning ist erforderlich – drei Few-Shot-Beispiele reichen aus, damit Modelle das Format wechseln. Die parse_r-Metrik geht von 0,29 auf 1,00 bei komplexen Aufgaben mit diesem Ansatz.

Ad

Der ?-Marker für Unsicherheit

WCY führt eine strukturelle Möglichkeit für LLMs ein, während des Denkprozesses zu markieren, was sie nicht wissen. Der ? (void-B)-Slot ermöglicht es Modellen, Unsicherheit inline anzuzeigen:

: ?diagnosis hint=labs+imaging conf_range=0.4..0.8
    order CT_scan reason=from=3 . CT_result mass_in_RUL size=2.3cm : diagnosis=adenocarcinoma conf=0.82 from=3,5

Tests zeigten:

  • Zero-Shot: Modelle verwenden ?-Marker 0% der Zeit, selbst mit der Spezifikation im Prompt
  • Mit 3 Beispielen: 5,4 Marker pro Trace, 67-97% gelöst
  • 48 Pipeline-Traces über 8 Domänen: 95% Auflösung, 100% Quality-Gate-Bestanden

Der from=-Slot verfolgt inline, welche Beobachtungen welche Schlussfolgerungen stützen, was hilft, Halluzinationsketten zu erkennen.

Verfügbare Ressourcen

  • wcy_parser.py – reines Python, keine externen Abhängigkeiten
  • wcy_eval.py – 3-Achsen-Bewertung (Strukturell / Bedeutung / Herkunft)
  • 60 Reasoning-Traces mit void-B-Zyklen (CC BY 4.0-Lizenz, für Fine-Tuning-Experimente)
  • Pipeline-Skript zum Generieren weiterer Traces

Bisher nur mit Claude Sonnet getestet. Der Autor ist neugierig, ob das 0% → 5,4 Marker-Ergebnis bei Qwen, Llama und Mistral mit denselben Few-Shot-Beispielen gilt.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

Kriminalteam: Multi-Agent-Orchestrator für OpenClaw — Parallele Code-Überprüfung mit Coder-Agent
Werkzeuge

Kriminalteam: Multi-Agent-Orchestrator für OpenClaw — Parallele Code-Überprüfung mit Coder-Agent

Crime Team v0.1 führt mehrere spezialisierte OpenClaw-Agenten parallel zur Code-Überprüfung aus und integriert die Ergebnisse. Enthält agentenspezifische Modelle, einen Coder-Agenten, der Änderungen anwendet, und eine erneute Prüfschleife. CLI + GUI.

OpenClawRadar
DESIGN.md: Ein Formatspezifikation zur Beschreibung visueller Identität für Coding-Agenten
Werkzeuge

DESIGN.md: Ein Formatspezifikation zur Beschreibung visueller Identität für Coding-Agenten

DESIGN.md kombiniert YAML-Design-Tokens mit Markdown-Prosa, um KI-Codierungsagenten ein persistentes, strukturiertes Verständnis eines Designsystems zu geben. Enthält einen Linter und ein Diff-Tool.

OpenClawRadar
Cortex: Eine lokale Speicherschicht für OpenClaw-Agenten mit Ebbinghaus-Abklang
Werkzeuge

Cortex: Eine lokale Speicherschicht für OpenClaw-Agenten mit Ebbinghaus-Abklang

Cortex ist ein Open-Source-Gedächtniswerkzeug, das entwickelt wurde, um Kontextkomprimierungsprobleme in OpenClaw-Agenten zu lösen. Es implementiert Ebbinghaus-Vergessenskurven für den Faktenverfall, importiert zuerst aus Dateien und läuft als einzelne 19 MB große Go-Binärdatei mit SQLite.

OpenClawRadar
CrabMeat v0.1.0: Ein sicherheitsorientierter Agenten-Gateway, das dem LLM die Sicherheitsgrenze nicht anvertraut
Werkzeuge

CrabMeat v0.1.0: Ein sicherheitsorientierter Agenten-Gateway, das dem LLM die Sicherheitsgrenze nicht anvertraut

CrabMeat v0.1.0 ist ein WebSocket-Gateway für agentische LLM-Workloads, das Sicherheit auf architektonischer Ebene erzwingt: Capability-ID-Indirektion, Effektklassen, IRONCLAD_CONTEXT fixierte Anweisungen, manipulationssichere Audit-Kette, Streaming-Output-Leak-Filter und kein YOLO-Modus.

OpenClawRadar