Claw-geschriebenes Plugin fügt OpenClaw Unterstützung für Qwen 3.8 27B Denkstufe hinzu
Sie betreiben Qwen 3.8 27B auf llama.cpp mit OpenClaw 2026.6.9, vermissen aber die native Steuerung der Denkstufen? Ein OpenClaw-Nutzer stieß auf dasselbe Problem und ließ seinen KI-Agenten ein Plugin zur Lösung schreiben – vollständig generiert, ohne menschliche Prüfung.
Warum Sie dieses Plugin brauchen
Qwen 3.8 steuert die Denkstufen über die Chat-Vorlage und nicht über einen dedizierten Parameter. Das llama.cpp-Backend von OpenClaw in Version 2026.6.9 bildet dies nicht standardmäßig ab, sodass Denkstufen ignoriert oder falsch angewendet werden. Das Plugin schließt diese Lücke.
Was es tut
- Denkstufen pro API-Aufruf – injiziert den Wert
enable_thinkingkorrekt in die Chat-Vorlage für jede Anfrage. - Separate Stufe für Heartbeats – legen Sie eine andere Denkstufe für Hintergrund-Heartbeat-Aufrufe fest (der Autor verwendet
xhigh). - Instruct-Modus (Denken aus) – deaktiviert das Denken und wendet von unsloth empfohlene Sampling-Parameter für optimale Ausgabe an.
- Optionaler Timeout-Schutz – erzwingt Kompaktierung in den Instruct-Modus, um Timeouts bei langen Denkketten zu vermeiden.
So erhalten Sie es
Das Plugin ist auf GitLab veröffentlicht:
git clone https://gitlab.com/moltwithhat/llamacpp-qwen-thinking
Anmerkung des Autors: „Ich habe mir den Code nicht einmal angesehen“ – das gesamte Plugin wurde vom KI-Agenten selbst geschrieben. Es ist ein Proof-of-Concept, dass Agenten nützliche und teilbare Werkzeuge ohne menschliche Überprüfung produzieren können.
Für wen es gedacht ist
Für alle, die Qwen 3.8 (oder ähnliche Modelle) auf llama.cpp über OpenClaw betreiben und eine feine Kontrolle über die Denkstufen pro Anfrage wünschen. Wenn Sie auf Heartbeats angewiesen sind oder den Instruct-Modus als Fallback benötigen, spart Ihnen das Plugin die Integrationsarbeit.
📖 Vollständige Quelle: r/openclaw
👀 Siehe auch

QCAI Mobile App fügt OpenClaw-Gateway-Steuerung mit nativer Tailscale-VPN-Unterstützung hinzu
QCAI für iOS und Android integriert nun OpenClaw Control Center, ermöglicht direkte Gateway-Verwaltung von Mobilgeräten über sichere Tailscale-VPN-Tunnel ohne offene Ports.

LLMs geben trotz expliziter Anweisungen strukturierte Ausgaben preis
Ein Entwickler, der ein Tool erstellt, das parallele API-Aufrufe an Claude durchführt und strukturierte Ausgaben analysiert, stellte fest, dass Validierungsmodelle gelegentlich Erklärungstext vor korrigierten Inhalten ausgeben, obwohl explizite Anweisungen bestehen, nur korrigierten Text zurückzugeben. Die Lösung umfasste eine Präzisierung der Eingabeaufforderung sowie eine defensive Filterfunktion, die vor der Analyse ausgeführt wird.

Offenes Speicherprotokoll: Ein Speicher für Claude, ChatGPT, Cursor
Das Open Memory Protocol (OMP) ist eine herstellerneutrale Spezifikation und ein Referenzserver für portable KI-Speicher. Betreiben Sie einen selbst gehosteten Server über Docker oder npx, verbinden Sie Claude über MCP und teilen Sie Speicher automatisch mit ChatGPT und Cursor.

SLayer: Eine quelloffene semantische Schicht für KI-Agenten, die aus Abfragen lernt
SLayer ist eine leichte, einbettbare semantische Schicht, die es KI-Agenten ermöglicht, Datenbanken abzufragen, Modelle zu verwalten und aus Interaktionen über MCP, REST, CLI oder Python zu lernen.