Höhlenmensch: Eine Claude-Code-Fähigkeit, die durch Höhlenmenschen-Sprache 75 % der Tokens einspart

Was Caveman macht
Caveman ist eine Claude Code-Fähigkeit, die Claude dazu bringt, wie ein Höhlenmensch zu sprechen, wodurch etwa 75 % der Token eingespart werden, während die volle technische Genauigkeit erhalten bleibt. Der Ansatz basiert auf der Beobachtung, dass Höhlenmenschensprache den LLM-Token-Verbrauch drastisch reduziert, ohne die technische Substanz zu verlieren.
Vorher- und Nachher-Beispiele
Die Quelle liefert konkrete Beispiele für die Token-Reduzierung:
- Normaler Claude (69 Token): "Der Grund, warum Ihre React-Komponente neu gerendert wird, liegt wahrscheinlich daran, dass Sie bei jedem Render-Zyklus eine neue Objektreferenz erstellen. Wenn Sie ein Inline-Objekt als Prop übergeben, sieht Reacts flacher Vergleich es jedes Mal als ein anderes Objekt an, was ein Neu-Rendering auslöst. Ich würde empfehlen, useMemo zu verwenden, um das Objekt zu memoisieren."
- Caveman Claude (19 Token): "Neue Objektreferenz bei jedem Rendern. Inline-Objekt-Prop = neue Referenz = Neu-Rendering. In useMemo einpacken."
- Normaler Claude: "Sicher! Ich helfe Ihnen gerne dabei. Das Problem, das Sie erleben, wird höchstwahrscheinlich durch Ihre Authentifizierungs-Middleware verursacht, die die Token-Ablaufzeit nicht richtig validiert. Lassen Sie mich einen Blick darauf werfen und einen Fix vorschlagen."
- Caveman Claude: "Fehler in Auth-Middleware. Token-Ablaufprüfung verwendet < statt <= . Fix:"
Installation
Installieren Sie mit einem dieser Befehle:
npx skills add JuliusBrussee/cavemanOder über das Claude Code-Plugin-System:
claude plugin marketplace add JuliusBrussee/caveman
claude plugin install caveman@cavemanVerwendung
Lösen Sie den Caveman-Modus mit diesen Phrasen aus:
- /caveman "sprechen wie Höhlenmensch"
- "caveman modus"
- "weniger token bitte"
Beenden Sie den Caveman-Modus mit:
- "stop caveman"
- "normaler modus"
Was Caveman ändert und beibehält
Caveman entfernt:
- Füllwörter
- Artikel (ein, eine, der/die/das)
- Höflichkeitsfloskeln (z.B. "Sicher, ich helfe gerne")
- Abschwächungen (z.B. "Es könnte sich lohnen zu überlegen")
Caveman behält bei:
- Codeblöcke (schreibt normal)
- Fachbegriffe (z.B. Polymorphismus bleibt Polymorphismus)
- Fehlermeldungen (zitiert genau)
- Git-Commits & PRs (schreibt normal)
Vorteile und Funktionsweise
Die Quelle nennt diese Vorteile:
- 75 % Token eingespart
- 100 % technische Genauigkeit beibehalten
- ~3-fache Geschwindigkeitssteigerung
- 75 % geringere Kosten für die Ausgabe
- Schnellere Antworten aufgrund weniger zu generierender Token
Caveman eliminiert verschwendete Token für Phrasen wie:
- "Ich helfe Ihnen gerne dabei" (8 verschwendete Token)
- "Der Grund dafür ist, dass" (7 verschwendete Token)
- "Ich würde empfehlen, dass Sie in Betracht ziehen" (7 verschwendete Token)
- "Sicher, lassen Sie mich das für Sie überprüfen" (10 verschwendete Token)
Repository-Details
Das Repository hat 746 Sterne, 14 Forks und verwendet die MIT-Lizenz. Die neueste Version ist v1.0.0 vom 4. April 2026.
📖 Quelle vollständig lesen: HN AI Agents
👀 Siehe auch

Claude Code UltraPlan Workflow-Änderungen und Leistungsbeobachtungen
Claude Code UltraPlan stellt einen cloudbasierten Planungsworkflow mit Terminalstart, Browser-Review-Oberfläche und Ausführungsoptionen vor. Tests zeigten etwa 2x schnellere Wiederholungsläufe als lokale Planung, mit gemischten Qualitätsverbesserungen.

Wie KI-Assistenten Webseiten abrufen: Nginx-Loganalyse von ChatGPT, Claude, Gemini und anderen
Ein Entwickler testete fünf große KI-Assistenten, indem er sie mit eindeutigen URLs ansprach und Nginx-Logs überwachte, wodurch unterschiedliche Abrufmuster aufgedeckt wurden: ChatGPT, Claude und Perplexity verwenden dedizierte User-Agents, während Gemini aus seinem Index antwortete, ohne eine Abfrage durchzuführen.

OpenClaw-Erweiterung leitet Anfragen über Claude Code CLI statt über die API weiter
Eine OpenClaw-Erweiterung startet die Claude CLI-Binärdatei als Unterprozess und leitet Anfragen über die Claude Code CLI statt über die Anthropic API. Dies bietet das vollständige Claude Code-Erlebnis zum Pauschalpreis eines Max-Plans.

Reddit-Benutzer misst MCP-Token-Overhead: 67.000 Token verbraucht, bevor überhaupt eine Frage gestellt wird
Ein Entwickler maß den Token-Overhead seines MCP-Servers mit 67.000 verbrauchten Token, bevor auch nur eine Frage gestellt wurde, wobei Playwright MCP 13.600 Token und GitHub MCP 18.000 Token im Leerlauf verbrauchte. Er ersetzte MCP durch Skills und CLI-Tools, um die Kontextkosten zu senken.