Claw-geschriebenes Plugin fügt OpenClaw Unterstützung für Qwen 3.8 27B Denkstufe hinzu

✍️ OpenClawRadar📅 Veröffentlicht: 20. August 2026🔗 Source
Ad

Sie betreiben Qwen 3.8 27B auf llama.cpp mit OpenClaw 2026.6.9, vermissen aber die native Steuerung der Denkstufen? Ein OpenClaw-Nutzer stieß auf dasselbe Problem und ließ seinen KI-Agenten ein Plugin zur Lösung schreiben – vollständig generiert, ohne menschliche Prüfung.

Warum Sie dieses Plugin brauchen

Qwen 3.8 steuert die Denkstufen über die Chat-Vorlage und nicht über einen dedizierten Parameter. Das llama.cpp-Backend von OpenClaw in Version 2026.6.9 bildet dies nicht standardmäßig ab, sodass Denkstufen ignoriert oder falsch angewendet werden. Das Plugin schließt diese Lücke.

Was es tut

  • Denkstufen pro API-Aufruf – injiziert den Wert enable_thinking korrekt in die Chat-Vorlage für jede Anfrage.
  • Separate Stufe für Heartbeats – legen Sie eine andere Denkstufe für Hintergrund-Heartbeat-Aufrufe fest (der Autor verwendet xhigh).
  • Instruct-Modus (Denken aus) – deaktiviert das Denken und wendet von unsloth empfohlene Sampling-Parameter für optimale Ausgabe an.
  • Optionaler Timeout-Schutz – erzwingt Kompaktierung in den Instruct-Modus, um Timeouts bei langen Denkketten zu vermeiden.
Ad

So erhalten Sie es

Das Plugin ist auf GitLab veröffentlicht:

git clone https://gitlab.com/moltwithhat/llamacpp-qwen-thinking

Anmerkung des Autors: „Ich habe mir den Code nicht einmal angesehen“ – das gesamte Plugin wurde vom KI-Agenten selbst geschrieben. Es ist ein Proof-of-Concept, dass Agenten nützliche und teilbare Werkzeuge ohne menschliche Überprüfung produzieren können.

Für wen es gedacht ist

Für alle, die Qwen 3.8 (oder ähnliche Modelle) auf llama.cpp über OpenClaw betreiben und eine feine Kontrolle über die Denkstufen pro Anfrage wünschen. Wenn Sie auf Heartbeats angewiesen sind oder den Instruct-Modus als Fallback benötigen, spart Ihnen das Plugin die Integrationsarbeit.

📖 Vollständige Quelle: r/openclaw

Ad

👀 Siehe auch

Lokale-Cloud-Hybride-KI-Architektur: Praktische Muster inspiriert von r/LocalLLaMA
Werkzeuge

Lokale-Cloud-Hybride-KI-Architektur: Praktische Muster inspiriert von r/LocalLLaMA

Der ursprüngliche Beitrag schlägt ein hybrides KI-Modell vor, bei dem ein lokales Modell Routineaufgaben übernimmt und komplexe Überlegungen über einen einzigen API-Aufruf an ein Cloud-Modell delegiert, zusammen mit einem deterministischen 'Hypervisor' für Sicherheitsvorkehrungen.

OpenClawRadar
Claude Code HUD: Terminal-Dashboard zur Überwachung von KI-Codierungssitzungen
Werkzeuge

Claude Code HUD: Terminal-Dashboard zur Überwachung von KI-Codierungssitzungen

claude-code-hud ist ein Terminal-Dashboard, das Echtzeit-Überwachung für Claude Code-Sitzungen bietet und die Nutzung des Kontextfensters, API-Ratenlimits und Dateiänderungen anzeigt, ohne eine IDE zu benötigen. Starten Sie es mit npx claude-code-hud.

OpenClawRadar
ClawCall fügt eingehende Anrufe hinzu – Ihr OpenClaw-Agent erhält eine eigene Nummer
Werkzeuge

ClawCall fügt eingehende Anrufe hinzu – Ihr OpenClaw-Agent erhält eine eigene Nummer

ClawCall unterstützt jetzt eingehende Anrufe – Ihr OpenClaw-Agent erhält eine eigene Nummer, hebt innerhalb von Sekunden ab und spricht mit Ihrem Ton. Einfachere Begrüßungs- und Persönlichkeitseinrichtung über natürliche Sprache.

OpenClawRadar
Claude-Real-Video: Szenenbewusste Bildauswahl + Transkript für jedes LLM
Werkzeuge

Claude-Real-Video: Szenenbewusste Bildauswahl + Transkript für jedes LLM

Ein Open-Source-Tool, das szenenbewusste, deduplizierte Frames und Audiotranskripte aus Videos extrahiert und es jedem LLM ermöglicht, ein Video lokal anzusehen, ohne es hochzuladen. Bietet Szenenerkennung, Sliding-Window-Deduplizierung und Whisper-Transkription.

OpenClawRadar