Warum KI-Coding-Agenten nach 20 Schritten Mist produzieren: Kontextblindheit

✍️ OpenClawRadar📅 Veröffentlicht: 20. Mai 2026🔗 Source
Warum KI-Coding-Agenten nach 20 Schritten Mist produzieren: Kontextblindheit
Ad

Ein Entwickler auf r/LocalLLaMA hat seine API-Logs und Prompt-Payloads geprüft, nachdem er bemerkt hatte, dass die Token-Nutzung anstieg und die Agentenausgabe nach etwa 20 Iterationen nachließ. Seine Schlussfolgerung: Die Modelle werden nicht dümmer; sie ersticken an ihren eigenen überladenen Kontextfenstern.

Die vier strukturellen Fehler

Nachdem er untersucht hatte, was Cursor und Claude Code in einem Repository mit über 10.000 Zeilen tatsächlich tun, identifizierte der Autor vier Muster:

  • Blinde Erkundung: Der Agent durchsucht rekursiv mit grep und legt etwa 40 verschiedene Dateien in den Kontext, nur um eine einzige Hilfsfunktion zu finden. Oft übersieht er eine vorhandene Komponente und halluziniert ein Duplikat von Grund auf.
  • Rohe Aufnahme: Eine 2.000-zeilige Datei wird in den Prompt geladen, um ein 5-zeiliges Interface zu aktualisieren. Verschwendet massiv Kontext-Token.
  • Tool-Durchfall: Ausführliche Testlogs und riesige MCP-Tool-Definitionen verbrauchen rund 30k Token, bevor das Modell ein einziges Code-Token generiert.
  • Goldfisch-Gedächtnis: Jede Sitzung beginnt von vorn – kein Projektbewusstsein – so dass dieselben Dateien immer wieder neu gelesen werden.
Ad

Kipppunkt bei 80% Kontext

Sobald der Kontext zu etwa 80% mit Rauschen gefüllt ist, verschlechtert sich der Aufmerksamkeitsmechanismus des Modells drastisch. Der IQ sinkt sichtbar auf Zimmertemperatur, und es beginnt, die Architektur zu zerstören. Standard-Chunking-RAG behebt dies nicht, da es für Logik ungeeignet ist – der Agent bleibt blind für die Codebasis-Struktur, bis er Token für das Lesen von Rohtext verbrennt.

Vorgeschlagene Lösung: AST oder Graph-DB

Der Autor fordert einen Open-Source-Agenten, der Code in einen AST oder eine Graphdatenbank parst, bevor er Kontext verbraucht, damit er die Struktur versteht, ohne Token für Rohtext zu verschwenden. Dies würde architektonische Spaghetti verhindern, die pro eingesparter Stunde Tipparbeit 5 Stunden Korrektur kosten.

Für wen das gedacht ist

Entwickler, die Cursor, Claude Code oder lokale LLM-Agenten für reale Codebasen verwenden und von Produktivitätsparadoxien frustriert sind.

📖 Lies die vollständige Quelle: r/LocalLLaMA

Ad

👀 Siehe auch

Claude Workflow-Bibliothek verfolgt und bewertet jetzt automatisch Workflows aus Reddit
Werkzeuge

Claude Workflow-Bibliothek verfolgt und bewertet jetzt automatisch Workflows aus Reddit

Ein durchsuchbares, automatisch aktualisiertes Verzeichnis von Claude- und Claude-Code-Workflows aus großen Subreddits mit Schritten, Artefakten und Community-Bewertungen.

OpenClawRadar
LLM Circuit Finder: Verdreifachen Sie Schichten, um das Denkvermögen ohne Training zu steigern
Werkzeuge

LLM Circuit Finder: Verdreifachen Sie Schichten, um das Denkvermögen ohne Training zu steigern

Ein neues Toolkit findet 'Reasoning Circuits' in Transformer-Modellen – zusammenhängende Blöcke von 3-4 Schichten, die als unteilbare kognitive Einheiten fungieren. Das Duplizieren dieser Blöcke (Schichten 12-14 in Devstral-24B) verbessert die logische Deduktion von 0,22 auf 0,76 in BBH-Benchmarks, ohne Gewichtsänderungen oder Training.

OpenClawRadar
DeepSeek V4 Flash liefert nahe Opus-Qualität für lokale LLMs vor Ort
Werkzeuge

DeepSeek V4 Flash liefert nahe Opus-Qualität für lokale LLMs vor Ort

Reddit-Benutzer berichtet, dass DeepSeek 4 Flash für lokale KI-Agenten mit vertraulichen Daten eine Leistung nahe Opus-Niveau erreicht und einen lokalen Einsatz ohne AWS ermöglicht. Läuft lokal mit NVIDIA-GPUs, aber bei 1M Token immer noch langsam.

OpenClawRadar
Open-Source Claude-Fähigkeiten für Produktmanager: PRD-Generator, User Stories, Meeting-Notizen
Werkzeuge

Open-Source Claude-Fähigkeiten für Produktmanager: PRD-Generator, User Stories, Meeting-Notizen

Ein Entwickler hat fünf kostenlose Claude AI-Fähigkeiten für Produktmanager veröffentlicht, die formatierte .docx-Dateien für PRDs, User Stories, Meeting-Synthesen, Marktforschung und Stakeholder-Updates generieren. Die Tools vermeiden halluzinierte Inhalte und nutzen strukturierte Vorlagen.

OpenClawRadar