Aufteilung von KI-Agenten, um Kontextverlust zu verhindern

Ein Entwickler auf r/openclaw beschreibt seinen Ansatz zur Verwaltung von KI-Agenten, indem er einen einzelnen Agenten in mehrere spezialisierte Agenten aufteilt, um die Einschränkungen des Kontextfensters zu bewältigen. Als ein Agent gleichzeitig Arbeits-Postfach, persönlichen Kalender, Code-Reviews und Abendplanung bearbeiten sollte, begann er, Kontext zu verlieren, was zur Aufteilung führte.
Agenten-Architektur
Der Entwickler betreibt mehrere KI-Agenten auf demselben Rechner mit folgender Konfiguration:
- Jeder Agent hat eine andere Aufgabe: persönlicher Assistent, Arbeit, Finanzen, Lebensstil
- Jeder hat seinen eigenen Speicher und Arbeitsbereich
- Agenten können standardmäßig nicht den Kontext der anderen sehen
- Die Kommunikation erfolgt über ein einfaches Mailbox-System, bei dem Agenten in isolierten Sitzungen Threads miteinander eröffnen können
Praktisches Beispiel
Der Entwickler liefert ein konkretes Beispiel für die Interaktion der Agenten:
- Benutzer sagt zum persönlichen Agenten: "plane eine Reise nach Japan im April"
- Persönlicher Agent kontaktiert den Lebensstil-Agenten, um Flüge und Hotels zu recherchieren
- Lebensstil-Agent liefert Optionen und konsultiert dann den Finanz-Agenten
- Finanz-Agent prüft das Budget und gibt Einschränkungen: "Flüge nach dem 15. kaufen" oder "dieses Hotel entspricht 40 % Ihres monatlichen Freizeitbudgets, hier sind zwei günstigere"
- Die Agenten verhandeln und liefern einen kohärenten Plan
Die entscheidende Erkenntnis ist, dass spezialisierte Agenten unterschiedliche Prioritäten haben – der Lebensstil-Agent optimiert für das Erlebnis, während der Finanz-Agent für Budgetbeschränkungen optimiert. So können sie verhandeln, anstatt dass ein Agent widersprüchliche Perspektiven jongliert.
Der Entwickler hat ein einfaches Mailbox-System für die Agentenkommunikation gebaut und fragt die Community nach Kommunikationsmustern, die für andere bei der Implementierung ähnlicher Multi-Agenten-Setups funktionieren.
📖 Vollständige Quelle lesen: r/openclaw
👀 Siehe auch

Entwickler baut Minecraft-Launcher mit Claude Code
Ein Entwickler mit über 20 Jahren Erfahrung nutzte Claude Code, um BlockHaven Launcher zu erstellen – einen Electron-basierten Minecraft-Launcher mit Microsoft-Authentifizierung, Modrinth-Mod-Browsing und isolierten Multi-Instance-Profilen. Das Projekt ist Open-Source und unter MIT-Lizenz verfügbar.

Modifiziertes vLLM 0.17.0 läuft auf Tesla P40 für Echtzeit-Transkription mit Qwen3 ASR 1.7B
Ein Entwickler hat vLLM 0.17.0 für die Pascal-Architektur von Tesla P40 GPUs angepasst und damit nahezu vollständige Hardwarebeschleunigung für die Echtzeit-Transkription von Vorlesungen mit dem Qwen3 ASR 1.7B Modell erreicht. Der Fork ist auf GitHub verfügbar.

Reddit-Nutzer berichtet über 30% Budgetverschwendung durch "AI-Agent-Neustart-Steuer", teilt Checkpointing-Lösung
Ein Entwickler auf r/LocalLLaMA stellte fest, dass sein Team 30 % seines KI-Budgets für Neustarts ausgab, wenn Workflows mitten in einer Aufgabe fehlschlugen. Sie führten Checkpointing für jeden Tool-Aufruf ein, was sofort die API-Kosten senkte, indem redundante Verarbeitung vermieden wurde.
Claude Code vs Codex: Aufschlüsselung eines praktischen Experiments mit 6 Projekten
Ein praktischer Experiment, das Claude Code und Codex in 6 Projekten vergleicht – Web, Backend und freie Challenge – mit gegenseitigen Reviews, Selbstaudits und Bewertungen.