Multi-Agenten-Handelsratssystem mit GPT-5.1 und Claude 4.6

Systemarchitektur und Komponenten
Ein Entwickler hat ein Multi-Agenten-Handelssystem implementiert, das darauf ausgelegt ist, eine strenge Begründung von Trading-Setups vor der Ausführung zu erzwingen. Das System verwendet ZagiHQ für die Orchestrierung, das speziell für seine Agenten-Sperrfunktionen und den Verzicht auf manuelle VM-Bereitstellung oder Containerverwaltung ausgewählt wurde. Intern wird die Multi-Agenten-Koordination von OpenFang gehandhabt, das die Kommunikation zwischen Knoten automatisiert.
Ablauf im Detail
Das System arbeitet in vier verschiedenen Phasen:
- Die Scouts: Drei parallele Agenten sammeln Daten: einer durchsucht hochwertige X (Twitter)-Konten, einer überwacht Makronachrichten von Bloomberg/Reuters-Feeds und einer zieht technische Indikatoren von TradingView. Alle Daten werden vor der Verarbeitung in ein gemeinsames Schema normalisiert.
- Der Rat: Drei Modelle analysieren die Daten gleichzeitig: GPT-5.1 übernimmt die Mustererkennung, Claude 4.6 Opus die makro-/technische Argumentation und Claude 4.6 Sonnet prüft die logische Konsistenz.
- Der Richter: Dieser Gatekeeper verwirft jeden Trade, bei dem es bedeutende Uneinigkeit über Einstieg, Stop Loss, Take Profit oder Risiko-Rendite-Verhältnis gibt. Es gibt keinen Überschreibungsmechanismus.
- Mensch-in-der-Schleife: Überlebende Setups lösen eine Telegram-Benachrichtigung mit vollständigen Modellanalysen aus. Alle Trades erfordern manuelle Genehmigung, und das System befindet sich derzeit nur im Papierhandel.
Erste Beobachtungen und aktuelle Herausforderungen
Der Entwickler berichtet, dass einzelne Modelle dazu neigen, sich anfängliche Interpretationen zu verankern und diese zu rationalisieren, während der Multi-Agenten-Ansatz mit Argumentationsschichten erheblichen Rauschen herausfiltert. Setups, die durchkommen, fühlen sich "stabiler" und schwerer zu kritisieren an.
Drei spezifische Probleme werden angegangen:
- X (Twitter)-Sentiment-Wert: Es wird hinterfragt, ob das Signal-Rausch-Verhältnis den Aufwand rechtfertigt, selbst mit LLM-Vorfilterung. Es wird erwogen, dies herabzustufen, es sei denn, klare makroökonomische Katalysatoren treiben die Diskussion an.
- Konsensfalle: Die Sorge, dass eine dreiseitige Übereinstimmung eher gemeinsame Trainingsverzerrungen als echte Signale widerspiegeln könnte. Es wird erwogen, einen "Advocatus Diaboli"-Agenten hinzuzufügen, der speziell darauf programmiert ist, Gründe gegen Trades zu finden.
- Richterverbesserung: Derzeit verwirft er Trades nur basierend auf Richtung und R:R. Es wird erwogen, Volatilitätsregime-Prüfungen und Mindestüberzeugungsschwellen (möglicherweise über logprobs, wenn zuverlässig) hinzuzufügen.
Der Entwickler ist bereit, Schemata zu teilen und den Workflow mit anderen zu diskutieren, die ähnliche Systeme aufbauen.
📖 Read the full source: r/clawdbot
👀 Siehe auch

Nakkas MCP-Server erzeugt animierte SVGs aus KI-Beschreibungen
Nakkas ist ein MCP-Server, bei dem KI vollständige animierte SVG-Konfigurationen aus Beschreibungen erstellt und saubere animierte SVGs mit Formen, Verläufen, Animationen und Filtern rendert. Es unterstützt parametrische Kurven, 15 Filtervoreinstellungen, CSS @keyframes- und SMIL-Animationen und funktioniert überall, wo SVG gerendert wird.

Benchmark zeigt: KI-Browser-Automatisierungstools variieren um das 2,6-fache bei den Token-Kosten trotz identischer Genauigkeit
Ein Benchmark von 4 CLI-Browser-Automatisierungstools mit Claude Sonnet 4.6 bei 6 realen Aufgaben ergab, dass alle 100% Genauigkeit erreichten, aber openbrowser-ai 36.010 Tokens verwendete, während andere 77.123–94.130 Tokens benötigten. Die Anzahl der Tool-Aufrufe war der stärkste Prädiktor für die Token-Kosten.

ScreenMind: Lokale KI-Erinnerung, die Ihre gesamte Computeraktivität indexiert
ScreenMind erfasst Bildschirm, Meetings und Sprachnotizen lokal mit Gemma 4 E2B via llama.cpp. Läuft auf 4 GB+ VRAM mit Q4-Quantisierung. Durchsuche vergangene Aktivitäten, chatte mit dem Verlauf und verbinde dich über MCP mit Claude/Cursor.

Claudes stiller Absturz: Der Ausfall der Handlungsebene, wenn KI-Agenten auf Geschäftsseiten treffen
Claude kann Geschäftsseiten (Preise, Buchungsabläufe, Formulare) lesen, scheitert jedoch an der Handlungsebene – Buchung, Übermittlung oder Weiterleitung – aufgrund fehlender aufrufbarer Endpunkte. Dies verursacht unsichtbare Nutzerabbrüche ohne Analysesignal.