Kurze Systemprompts verbessern Claudes Compliance und reduzieren Token-Verschwendung

✍️ OpenClawRadar📅 Veröffentlicht: 29. April 2026🔗 Source
Kurze Systemprompts verbessern Claudes Compliance und reduzieren Token-Verschwendung
Ad

Ein Nutzer auf r/ClaudeAI berichtete, dass er nach acht Monaten Kampf mit einem massiven 3.847 Wörter umfassenden System-Prompt – der Anforderungen, Codierungsstandards, Projektkontext, Persönlichkeitspräferenzen und Fehlerbehandlung abdeckte – die Ursache entdeckte: Der Prompt war zu lang.

Claude fing stark an, vergaß aber allmählich die Hälfte der Anweisungen oder ignorierte Teile, die nicht passten. Der Nutzer fragte Claude selbst, warum es ständig Anweisungen vergaß, und das Modell deutete an, dass die Prompts zu lang waren.

Die Lösung bestand darin, den einzelnen riesigen Prompt durch mehrere winzige, fokussierte Prompts zu ersetzen, insgesamt etwa 200 Wörter:

  • "Schreibe zuerst Tests. Verwende Jest. Deck Randfälle ab."
  • "Erkläre deine Codeänderungen in Stichpunkten."
  • "Frage, bevor du neue Abhängigkeiten installierst."

Nach drei Wochen Tests berichtet der Nutzer, dass Claude diese kurzen Prompts konsequent befolgt, Gespräche nicht mehr in zufällige Abschweifungen abdriften und die Token-Nutzung gesunken ist, da weniger überflüssiger Text verarbeitet werden muss. Bemerkenswerterweise gab es keine einzige Konversation, in der Claude unaufgefordert damit begann, die Codebasis zu refaktorisieren.

Ad

Die Erkenntnis: Kurze Prompts erzwingen Spezifität darüber, was man wirklich will, anstatt zu versuchen, jedes Szenario vorherzusehen, und Claude arbeitet besser, wenn ihm Raum zum Denken gegeben wird, anstatt einer Romans Länge an Einschränkungen.

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

Ein vollständig lokaler KI-Agent auf einem Laptop mit 6 GB VRAM: Eine Schritt-für-Schritt-Anleitung für Studierende
Tipps

Ein vollständig lokaler KI-Agent auf einem Laptop mit 6 GB VRAM: Eine Schritt-für-Schritt-Anleitung für Studierende

Erforschen Sie, wie Studenten 6GB VRAM-Laptops nutzen können, um KI-Agenten lokal auszuführen, ohne auf kostspielige APIs angewiesen zu sein. Unser Leitfaden erläutert die wesentlichen Schritte und Werkzeuge.

OpenClawRadar
Fehlstellen in Beiträgen zum Claude Code Workflow: Wiederherstellung, Einschränkungen und Berechtigungsverwaltung
Tipps

Fehlstellen in Beiträgen zum Claude Code Workflow: Wiederherstellung, Einschränkungen und Berechtigungsverwaltung

Happy-Path-Claude-Code-Workflows sind üblich, aber sie vernachlässigen die Wiederherstellung nach schlechten Bearbeitungen, die Durchsetzung von Einschränkungen und das Berechtigungsmanagement – entscheidend für den praktischen Einsatz.

OpenClawRadar
Haben Sie in einem Monat 850 Dollar für OpenClaw ausgegeben? Beheben Sie Ihre Architektur, nicht Ihr Modell
Tipps

Haben Sie in einem Monat 850 Dollar für OpenClaw ausgegeben? Beheben Sie Ihre Architektur, nicht Ihr Modell

Ein Entwickler verbrannte in einem Monat 850 $ für ein OpenClaw-Multi-Agenten-Setup – davon 350 $ an einem einzigen Tag. Die Lösung war nicht ein günstigeres Modell, sondern das Systemdesign: striktes Context-Pruning, Sitzungsrücksetzungen, n8n für Nicht-Denksportaufgaben und eine Routing-Ebene für günstige vs. leistungsstarke Modelle.

OpenClawRadar
Llama.cpp-Promptverarbeitungsgeschwindigkeitsoptimierung mit dem Parameter --ubatch-size
Tipps

Llama.cpp-Promptverarbeitungsgeschwindigkeitsoptimierung mit dem Parameter --ubatch-size

Ein Nutzer stellte fest, dass das Setzen von --ubatch-size entsprechend der GPU-L3-Cache-Größe (64 MB für Radeon 9070XT) die Prompt-Verarbeitungsgeschwindigkeit für größere Modelle wie Qwen 27B in Llama.cpp dramatisch verbesserte, wodurch Claude-Code-Aufrufe nutzbar wurden.

OpenClawRadar