Fix Ollama Cloud Model maxTokens: Obergrenze ist 16K, nicht der Konfigurationswert

✍️ OpenClawRadar📅 Veröffentlicht: 3. Juni 2026🔗 Source
Fix Ollama Cloud Model maxTokens: Obergrenze ist 16K, nicht der Konfigurationswert
Ad

PSA für alle, die bei Produktions-Turns unexpected EOF von Agents sehen: Wenn eure openclaw.json Cloud-Modelleinträge wie { "id": "deepseek-v4-pro:cloud", "maxTokens": 500000 } enthält, ist dieses maxTokens nicht real. Ollama Cloud begrenzt die Ausgabe serverseitig auf 16.384 Token, unabhängig von eurer Konfiguration. Wenn ein Agent versucht, etwas darüber hinaus zu senden, beendet der Upstream die Verbindung mitten im Stream, und ihr seht einen Transportfehler von ollama.com:443. OpenClaw behandelt das als Timeout-Failover und versucht euren Fallback – aber wenn der Fallback ebenfalls ein :cloud-Modell ist, gilt die gleiche Grenze.

Ad

Was geholfen hat

  • maxTokens bei Cloud-Einträgen korrigieren, damit OpenClaw keine Output-Budgets anfordert, die der Dienst nicht einhält:
    { "id": "deepseek-v4-pro:cloud", "maxTokens": 14000 }
    { "id": "kimi-k2.6:cloud", "maxTokens": 14000 }
    14k statt 16k – etwas Spielraum, da Modelle manchmal direkt am Limit seltsam reagieren.
  • Große strukturierte Ausgaben umstrukturieren (lange JSONs, mehrteilige Inhalte), sodass ein Abschnitt pro Turn ausgegeben wird, anstatt alles in einem Stapel zu verarbeiten. Bleibt unter der Grenze und Wiederholungen sind sauberer.
  • Schwere Agents direkt an einen Anbieter leiten über einen Pro-Agent-Modell-Override in agents.list[], statt über :cloud. Agents mit kleinen Ausgaben bleiben auf Ollama Cloud. Einmalige Einrichtung:
    openclaw onboard --auth-choice deepseek-api-key
    Dann in agents.list die benötigten überschreiben:
    "list": [ { "id": "your-agent", "model": "deepseek/deepseek-v4-pro" } ]
    Kompromiss: Abrechnung pro Token statt Pauschalgebühr, aber beschränkt auf Agents, die Spielraum benötigen.

Fazit

Wenn eure Agents mitten in langen Ausgaben fehlschlagen und ihr die offensichtlichen Dinge geprüft habt, schaut euch das tatsächliche Output-Limit eures Anbieters an, bevor ihr euch im OpenClaw-Bug-Kaninchenbau verliert. Die Fehlermeldung ist nutzlos und das Konfigurationsfeld verrät nicht, dass es serverseitig überschrieben wird.

📖 Vollständige Quelle lesen: r/openclaw

Ad

👀 Siehe auch

Ein Zwei-Schritt-KI-Workflow für die Modernisierung von Legacy-Code
Tipps

Ein Zwei-Schritt-KI-Workflow für die Modernisierung von Legacy-Code

Ein Reddit-Beitrag skizziert einen zweistufigen 'Reverse Engineering'-Ansatz für den Einsatz von KI mit Legacy-Code: Zuerst wird die Geschäftslogik in ein technologieunabhängiges Business Requirement Document extrahiert, dann wird ein 'Master Architect'-Prompt verwendet, um von Grund auf mit modernen Best Practices neu aufzubauen.

OpenClawRadar
Verwenden von Projektberichten zur Verwaltung des Speichers in großen OpenClaw-Projekten
Tipps

Verwenden von Projektberichten zur Verwaltung des Speichers in großen OpenClaw-Projekten

Ein Entwickler beschreibt einen Prozess, bei dem nach jedem wichtigen Meilenstein ein separater OpenClaw-Worker gestartet wird, um die Codebasis zu analysieren und ein 'Projektnarrativ'-Dokument zu erstellen, das dabei hilft, defekte Pipelines, Redundanzen und fehlende Teile zu identifizieren, die der Haupt-Worker möglicherweise übersieht.

OpenClawRadar
Reduzierung von Halluzinationen bei Claude durch Pre-Output Prompt Injection
Tipps

Reduzierung von Halluzinationen bei Claude durch Pre-Output Prompt Injection

Ein Reddit-Beitrag beschreibt eine Methode, um Halluzinationen von Claude AI um die Hälfte zu reduzieren, indem ein Vorausgabe-Prompt verwendet wird, der das Modell zwingt, Unsicherheiten und nächste Schritte vor der Antwort zu dokumentieren. Der Ansatz beinhaltet das Hinzufügen spezifischer Markdown-Anweisungen zum System-Prompt von Claude und das Erstellen eines Python-Skripts.

OpenClawRadar
Claude-Benutzereinstellungen: Ein Reddit-Nutzer-Setup für präzise, kritische Antworten
Tipps

Claude-Benutzereinstellungen: Ein Reddit-Nutzer-Setup für präzise, kritische Antworten

Ein Reddit-Nutzer teilt seine Claude User Preferences-Anpassungen, um weniger geschäftliche und direkt kritische Antworten zu erhalten. Tipps zur Vermeidung von Wiederholungen, zum Beginnen mit Schlussfolgerungen und zur Vereinfachung der Zeichensetzung.

OpenClawRadar