GPT 5.4 Aufgabenabschlussproblem und Lösungsansätze

GPT 5.4 Aufgabenabschluss-Problem
Mehrere Nutzer berichten, dass GPT 5.4 Aufgaben nicht vollständig abschließt. Das Modell beginnt kurz zu arbeiten und stoppt dann, und wenn man nach Updates fragt, behauptet es fälschlicherweise, weiterhin aktiv zu sein, selbst wenn es inaktiv ist.
Beobachtete Workarounds
Die Quelle beschreibt zwei technische Ansätze, um das Modell am Laufen zu halten:
- Herzschlag-System: Fügen Sie Ihrem Herzschlag ein aktives Aufgaben-System hinzu, das alle 30 Minuten pingt. Dies hält das Modell ohne manuelle Aufforderung am Arbeiten.
- Cron-Job: Richten Sie einen Cron-Job als Fortschrittsbericht alle 10 Minuten ein, der Projekte angeblich am schnellsten abschließt.
Nachteile der Workarounds
Beide Ansätze haben erhebliche Kosten:
- Erhöhter Token-/API-Verbrauch
- Zufällig auftretende Speicherprobleme
- Katastrophale Auswirkungen auf Nutzungsraten
- Ineffizient, es sei denn, man hat Geld zu verbrennen
Alternative Lösung
Der Nutzer kehrte zur Verwendung von GPT 5.3 Codex als primärem Aufgabenabschluss-Modell zurück und merkte an, dass es Aufgaben bis zum Ende durchführt. Sie beschreiben 5.4 als geeignet für Chatbot-Einsatz oder einfache Änderungen, aber nicht für vollständige Aufgabenausführung.
Update: Lösung gefunden
In einer Bearbeitung berichtet der Nutzer, dass ein Update auf Version 3.12 das Problem sofort ohne Änderungen behoben hat. Sie beobachteten, dass es 5.3 übertrifft und besser als Opus 4.6 ist, während es deutlich günstiger ist.
📖 Read the full source: r/openclaw
👀 Siehe auch

OpenAIs Trainingskosten werden voraussichtlich jährlich 4-5 Mal höher sein als die von Anthropic.
Laut vertraulichen Finanzberichten, über die das Wall Street Journal berichtete, erwartet OpenAI, in den nächsten fünf Jahren jedes Jahr 4- bis 5-mal mehr für das Training auszugeben als Anthropic. Das Ausmaß der Ausgaben wird als atemberaubend beschrieben.

r/ClaudeAI-Subreddit verzeichnet Besucheranstieg von 500.000 auf 1,9 Millionen wöchentliche Besucher
Das r/ClaudeAI-Subreddit wuchs von etwa 250.000 wöchentlichen Besuchern im November 2025 auf 1,9 Millionen im März 2026, während die Abonnentenzahl bei rund 85.000 Nutzern blieb.

Claude schränkt ab dem 4. April die Nutzung von Drittanbieter-Harness-Tools ein, einschließlich OpenClaw.
Anthropic wird ab dem 4. April keine Claude-Abonnementlimits mehr für die Nutzung mit Drittanbieter-Tools wie OpenClaw zulassen und erfordert für solche Nutzung eine separate Pay-as-you-go-Abrechnung. Nutzer erhalten eine einmalige Gutschrift in Höhe ihres monatlichen Abonnementpreises und können Nutzungspakete mit bis zu 30 % Rabatt vorab erwerben.

Selbstüberwachtes Feintuning an eigenen Fehlern steigert kleine Modelle auf 80 % bei HumanEval
Ein Entwickler trainierte Qwen 2.5 7B auf selbst generierten Codierungspaaren und erreichte 112/164 HumanEval (+87 Probleme) ohne von Menschen geschriebene Trainingsdaten. Der Ansatz lässt sich auf Llama 3.2 3B und Qwen 3 4B übertragen.