Claw-geschriebenes Plugin fügt OpenClaw Unterstützung für Qwen 3.8 27B Denkstufe hinzu
Sie betreiben Qwen 3.8 27B auf llama.cpp mit OpenClaw 2026.6.9, vermissen aber die native Steuerung der Denkstufen? Ein OpenClaw-Nutzer stieß auf dasselbe Problem und ließ seinen KI-Agenten ein Plugin zur Lösung schreiben – vollständig generiert, ohne menschliche Prüfung.
Warum Sie dieses Plugin brauchen
Qwen 3.8 steuert die Denkstufen über die Chat-Vorlage und nicht über einen dedizierten Parameter. Das llama.cpp-Backend von OpenClaw in Version 2026.6.9 bildet dies nicht standardmäßig ab, sodass Denkstufen ignoriert oder falsch angewendet werden. Das Plugin schließt diese Lücke.
Was es tut
- Denkstufen pro API-Aufruf – injiziert den Wert
enable_thinkingkorrekt in die Chat-Vorlage für jede Anfrage. - Separate Stufe für Heartbeats – legen Sie eine andere Denkstufe für Hintergrund-Heartbeat-Aufrufe fest (der Autor verwendet
xhigh). - Instruct-Modus (Denken aus) – deaktiviert das Denken und wendet von unsloth empfohlene Sampling-Parameter für optimale Ausgabe an.
- Optionaler Timeout-Schutz – erzwingt Kompaktierung in den Instruct-Modus, um Timeouts bei langen Denkketten zu vermeiden.
So erhalten Sie es
Das Plugin ist auf GitLab veröffentlicht:
git clone https://gitlab.com/moltwithhat/llamacpp-qwen-thinking
Anmerkung des Autors: „Ich habe mir den Code nicht einmal angesehen“ – das gesamte Plugin wurde vom KI-Agenten selbst geschrieben. Es ist ein Proof-of-Concept, dass Agenten nützliche und teilbare Werkzeuge ohne menschliche Überprüfung produzieren können.
Für wen es gedacht ist
Für alle, die Qwen 3.8 (oder ähnliche Modelle) auf llama.cpp über OpenClaw betreiben und eine feine Kontrolle über die Denkstufen pro Anfrage wünschen. Wenn Sie auf Heartbeats angewiesen sind oder den Instruct-Modus als Fallback benötigen, spart Ihnen das Plugin die Integrationsarbeit.
📖 Vollständige Quelle: r/openclaw
👀 Siehe auch

Multi-Operator Claude Code: Hub-basierte Architektur für Multi-Agent-Sessions
Ein Hub-basiertes Setup für Claude Code ermöglicht mehreren Personen, an derselben Sitzung teilzunehmen, Teilaufgaben über Repos zu verteilen und headless Agents in Docker-Containern auszuführen.

AGI in md: 11 kognitive Komprimierungsstufen für Claude-Systemprompts
Ein GitHub-Repository dokumentiert 11 Stufen kognitiver Kompression, die in Claude-Systemprompts kodiert werden können, wobei Stufe 8 von der Analyse zur Konstruktion wechselt und Haikus Leistung von 0/3 auf 4/4 verbessert. Das Projekt umfasst 28 Prompts, 299 Rohausgaben und vollständige Experimentprotokolle über 19 Domänen hinweg.

LamBench: Eine Lambda-Kalkül-Benchmark-Suite für KI-Codierungsagenten
LamBench ist eine Benchmark-Suite, die KI-Agenten anhand von Lambda-Kalkül-Aufgaben bewertet und Intelligenz, Geschwindigkeit und Eleganz misst. Die v1-Veröffentlichung umfasst Probleme und eine Bewertungsmatrix.

KONTAKT: 3D-Naval-Kampfspiel, vollständig mit Claude Code erstellt
CONTACT ist ein 3D-Marinekampfspiel, das vollständig mit Claude Code + Opus erstellt wurde. Es verfügt über einen 7×7×7 volumetrischen Würfel, eine Kreditwirtschaft mit taktischen Vorteilen und drei Spielmodi, darunter Mensch gegen Claude und Sonnet gegen Sonnet mit anhaltendem strategischem Gedächtnis.