Claude Code lädt Tool-Schemata per ToolSearch lazy, um Token zu sparen

Eine Reddit-Analyse des System-Prompts von Claude Code zeigt, dass Tools lazy-geladen werden, um den Token-Verbrauch zu senken. Statt das vollständige Schema jedes Tools mit jeder Anfrage zu senden, sendet Claude Code eine Liste der Tool-Namen in einem <system-reminder>-Tag und weist das Modell an, zuerst ToolSearch aufzurufen, um das Schema für jedes Tool zu laden.
Wie es funktioniert
Der System-Prompt enthält eine Anweisung wie diese:
<system-reminder> Die folgenden zurückgestellten Tools sind jetzt über ToolSearch verfügbar. Ihre Schemata sind NICHT geladen – ein direkter Aufruf führt zu einem InputValidationError. Verwenden Sie ToolSearch mit der Abfrage "select:<name>[,<name>...]", um die Tool-Schemata vor dem Aufruf zu laden:AskUserQuestion CronCreate CronDelete CronList EnterPlanMode EnterWorktree ExitPlanMode ExitWorktree Monitor NotebookEdit PushNotification RemoteTrigger TaskOutput TaskStop TodoWrite WebFetch WebSearch
[+ ~130 MCP-Tools (Slack, Notion, Gmail...)] </system-reminder>
Der <system-reminder> wird nur in der ersten Benutzernachricht des Gesprächs eingefügt. Ein ähnlicher Block listet Fähigkeiten mit einzeiligen Beschreibungen auf.
Auswirkungen auf den Token-Verbrauch
Laut dem Beitrag verbrauchten die Systemanweisungen zusammen mit den Erinnerungen bei einer einfachen Testnachricht mit "hi" bereits 38k Tokens. Das vollständige Laden aller Tool-Schemata würde diesen Verbrauch drastisch erhöhen – daher der Ansatz des verzögerten Ladens.
Praktische Implikationen
Wenn Sie auf Claude Code oder ähnlichen agentenbasierten Systemen aufbauen, lohnt es sich, dieses Muster zu übernehmen:
- Verschieben Sie Schemata für selten genutzte Tools, bis sie benötigt werden.
- Verwenden Sie einen
ToolSearch-ähnlichen Befehl, um explizit Schemata anzufordern. - Halten Sie Erinnerungen innerhalb der ersten Nachricht, um Kontextwiederholungen zu vermeiden.
Das bedeutet auch, dass Sie beim Schreiben benutzerdefinierter Tools für Claude Code sicherstellen müssen, dass das Modell sie über ToolSearch finden kann – sonst sind sie unsichtbar oder verursachen Validierungsfehler.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Schwarzes LLAB: Open-Source-Architektur für dynamisches Modell-Routing und Docker-isolierte KI-Agenten
Ein Entwickler hat Black LLAB als Open-Source-Projekt veröffentlicht, ein System, das Mistral 3B nutzt, um Anfragen zwischen lokalen und Cloud-Modellen zu routen und KI-Agenten in isolierten Docker-Containern mit OpenClaw-Integration auszuführt.

MCP-Server verbindet Claude mit CellarTracker-Weinbestand
Ein Entwickler hat einen MCP-Server erstellt, der Claude direkt mit CellarTracker-Konten verbindet und es ermöglicht, konversationelle Abfragen zu Weinbeständen, Verkostungsnotizen, Kaufhistorie und Trinkfenstern ohne manuelle CSV-Exporte durchzuführen.

Claude debuggt und behebt seinen eigenen MCP-Dateisystem-Server-UNC-Pfad-Fehler unter Windows
Ein Entwickler nutzte Claude Opus, um einen Fehler im MCP Filesystem Server zu diagnostizieren und zu beheben, bei dem UNC-Netzwerkfreigabepfade unter Windows für Unterverzeichnisoperationen fehlschlugen. Die Korrektur behebt ein Pfadvalidierungsproblem, das den Zugriff auf Dateien und Ordner innerhalb von UNC-Freigaben verhinderte.

W2A – ein offenes Protokoll für Agentensensoren: Lokale Agenten mit Echtzeitwahrnehmung ausstatten
W2A (World2Agent) ist ein offenes Protokoll, das die Wahrnehmungsschicht für KI-Agenten standardisiert – selbst hostbar, TS SDK, Apache 2.0. Es ermöglicht Agenten, Echtzeitsignale von Sensoren zu empfangen, ohne individuelle Skripte.