Claw-geschriebenes Plugin fügt OpenClaw Unterstützung für Qwen 3.8 27B Denkstufe hinzu
Sie betreiben Qwen 3.8 27B auf llama.cpp mit OpenClaw 2026.6.9, vermissen aber die native Steuerung der Denkstufen? Ein OpenClaw-Nutzer stieß auf dasselbe Problem und ließ seinen KI-Agenten ein Plugin zur Lösung schreiben – vollständig generiert, ohne menschliche Prüfung.
Warum Sie dieses Plugin brauchen
Qwen 3.8 steuert die Denkstufen über die Chat-Vorlage und nicht über einen dedizierten Parameter. Das llama.cpp-Backend von OpenClaw in Version 2026.6.9 bildet dies nicht standardmäßig ab, sodass Denkstufen ignoriert oder falsch angewendet werden. Das Plugin schließt diese Lücke.
Was es tut
- Denkstufen pro API-Aufruf – injiziert den Wert
enable_thinkingkorrekt in die Chat-Vorlage für jede Anfrage. - Separate Stufe für Heartbeats – legen Sie eine andere Denkstufe für Hintergrund-Heartbeat-Aufrufe fest (der Autor verwendet
xhigh). - Instruct-Modus (Denken aus) – deaktiviert das Denken und wendet von unsloth empfohlene Sampling-Parameter für optimale Ausgabe an.
- Optionaler Timeout-Schutz – erzwingt Kompaktierung in den Instruct-Modus, um Timeouts bei langen Denkketten zu vermeiden.
So erhalten Sie es
Das Plugin ist auf GitLab veröffentlicht:
git clone https://gitlab.com/moltwithhat/llamacpp-qwen-thinking
Anmerkung des Autors: „Ich habe mir den Code nicht einmal angesehen“ – das gesamte Plugin wurde vom KI-Agenten selbst geschrieben. Es ist ein Proof-of-Concept, dass Agenten nützliche und teilbare Werkzeuge ohne menschliche Überprüfung produzieren können.
Für wen es gedacht ist
Für alle, die Qwen 3.8 (oder ähnliche Modelle) auf llama.cpp über OpenClaw betreiben und eine feine Kontrolle über die Denkstufen pro Anfrage wünschen. Wenn Sie auf Heartbeats angewiesen sind oder den Instruct-Modus als Fallback benötigen, spart Ihnen das Plugin die Integrationsarbeit.
📖 Vollständige Quelle: r/openclaw
👀 Siehe auch

Lokale-Cloud-Hybride-KI-Architektur: Praktische Muster inspiriert von r/LocalLLaMA
Der ursprüngliche Beitrag schlägt ein hybrides KI-Modell vor, bei dem ein lokales Modell Routineaufgaben übernimmt und komplexe Überlegungen über einen einzigen API-Aufruf an ein Cloud-Modell delegiert, zusammen mit einem deterministischen 'Hypervisor' für Sicherheitsvorkehrungen.

Claude Code HUD: Terminal-Dashboard zur Überwachung von KI-Codierungssitzungen
claude-code-hud ist ein Terminal-Dashboard, das Echtzeit-Überwachung für Claude Code-Sitzungen bietet und die Nutzung des Kontextfensters, API-Ratenlimits und Dateiänderungen anzeigt, ohne eine IDE zu benötigen. Starten Sie es mit npx claude-code-hud.

ClawCall fügt eingehende Anrufe hinzu – Ihr OpenClaw-Agent erhält eine eigene Nummer
ClawCall unterstützt jetzt eingehende Anrufe – Ihr OpenClaw-Agent erhält eine eigene Nummer, hebt innerhalb von Sekunden ab und spricht mit Ihrem Ton. Einfachere Begrüßungs- und Persönlichkeitseinrichtung über natürliche Sprache.

Claude-Real-Video: Szenenbewusste Bildauswahl + Transkript für jedes LLM
Ein Open-Source-Tool, das szenenbewusste, deduplizierte Frames und Audiotranskripte aus Videos extrahiert und es jedem LLM ermöglicht, ein Video lokal anzusehen, ohne es hochzuladen. Bietet Szenenerkennung, Sliding-Window-Deduplizierung und Whisper-Transkription.