Claude-Systemprompt-Compliance verschlechtert sich in langen Gesprächen

Ein Reddit-Benutzer berichtet, dass die Einhaltung von Claudes Systemaufforderungen in langen Gesprächen erheblich abnimmt, was insbesondere KI-Codierungsagenten mit spezifischen Formatierungsregeln und Einschränkungen betrifft.
Problemdetails
Der Benutzer betreibt mehrere Claude-basierte Agenten für interne Tools, wobei jede Systemaufforderung spezifische Regeln zu Ausgabeformaten, zu vermeidenden Themen und der Behandlung von Grenzfällen enthält. Während diese für die ersten 20-30 Austausche perfekt funktionieren, beginnt die Einhaltung um Nachricht 40-50 nachzulassen.
Spezifisch beobachtete Probleme:
- Agenten befolgen Formatierungsregeln nicht mehr
- Sie werden auf Weisen "hilfreich", die die Systemaufforderung ausdrücklich verbietet
- Sie vergessen Einschränkungen, die zu Beginn klar waren
Der Benutzer merkt an, dass dies kein Fehler ist, sondern wie Kontextfenster unter Druck funktionieren, wobei Systemaufforderungen mit 40+ Nachrichten Konversationshistorie um Aufmerksamkeitsgewicht konkurrieren.
Workarounds und Lösungen
Der Benutzer teilt mehrere praktische Ansätze, die funktioniert haben:
- Kritische Regeln wiederholen: Alle 15-20 Nachrichten die wichtigsten 3 Regeln, die Sie nicht verlieren können, in komprimierter Form wiederholen (nicht die vollständige Systemaufforderung)
- Gespräche kürzer halten: Wenn eine Aufgabe mehr als 30 Austausche erfordert, starten Sie eine neue Sitzung mit einer Zusammenfassung des bisher Geschehenen
- Strategische Platzierung von Aufforderungen: Setzen Sie Ihre wichtigsten Einschränkungen sowohl an den Anfang ALS AUCH ans Ende der Systemaufforderung, da Modelle beiden Positionen mehr Aufmerksamkeit schenken
- Im großen Maßstab testen: Testen Sie Ihre Agenten bei Nachricht 50, nicht nur bei Nachricht 5, da einfache Demos dieses Problem nicht aufdecken
Der Benutzer betont, dass dieses Problem nicht genug diskutiert wird und lädt andere ein, zuverlässige Muster zur Aufrechterhaltung der Anweisungsbefolgung in lang laufenden Sitzungen zu teilen.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Claude-App belegt nach Pentagon-Streit zweiten Platz im US-App-Store
Die Claude-Chatbot-App von Anthropic stieg auf Platz zwei der kostenlosen Apps im US-App Store von Apple auf, nachdem sie Ende Januar 2026 noch außerhalb der Top 100 lag und bis Ende Februar den zweiten Platz erreichte. Dieser Anstieg folgte auf die öffentlichen Verhandlungen des Unternehmens mit dem Pentagon über Einschränkungen der KI-Nutzung.

OpenClaw 2026.4.29 defekt – Downgrade auf 2026.2.6
OpenClaw Version 2026.4.29 ist defekt: zufällige Fehler, langsame CLI, doppelte Antworten. Ein Downgrade auf 2026.2.6 behebt das Problem.

Claude Code v2.1.225 behebt OAuth-Token-Rotation und fügt Gateway-Ausgabenlimit-Unterstützung hinzu
v2.1.225 behebt einen vorübergehenden 401-Fehler, der Headless-Sitzungen unterbrach, fügt Gateway-Ausgabenlimits hinzu und verbessert die Remote-Control-Funktionen.

Xiaomi veröffentlicht MiMo-V2.5-Pro als Open Source: Nähert sich Claude Opus 4.6 bei Programmier-Benchmarks
Xiaomi hat MiMo-V2.5-Pro veröffentlicht, ein Open-Source-Coding-Modell, das bei einem Universitäts-Compiler-Projekt 233/233 Punkte erzielte, eigenständig einen Videoeditor entwickelte und auf SWE-Bench und Terminal-Bench innerhalb der besten 1% von Claude Opus 4.6 liegt.