Plugin Escrito com Claw Adiciona Suporte ao Nível de Pensamento Qwen 3.8 27B ao OpenClaw
Executando Qwen 3.8 27B no llama.cpp com OpenClaw 2026.6.9, mas sem controle nativo do nível de pensamento? Um usuário do OpenClaw encontrou o mesmo problema e deixou seu agente de IA escrever um plugin para corrigi-lo — totalmente gerado, sem teste por olhos humanos.
Por que você precisa deste plugin
O Qwen 3.8 controla os níveis de pensamento via template de chat, em vez de um parâmetro dedicado. O backend llama.cpp do OpenClaw versão 2026.6.9 não mapeia isso por padrão, então os níveis de pensamento são ignorados ou aplicados incorretamente. O plugin preenche essa lacuna.
O que ele faz
- Níveis de pensamento por chamada de API — injeta corretamente o valor
enable_thinkingno template de chat para cada solicitação. - Nível separado para heartbeats — defina um nível de pensamento diferente para chamadas de heartbeat em segundo plano (o autor usa
xhigh). - Modo de instrução (pensamento desativado) — desativa o pensamento e aplica parâmetros de amostragem recomendados pela unsloth para saída ideal.
- Proteção opcional de timeout — força compactação para o modo de instrução para evitar timeouts durante cadeias de raciocínio longas.
Como obter
O plugin está publicado no GitLab:
git clone https://gitlab.com/moltwithhat/llamacpp-qwen-thinking
Nota do autor: “Eu nem olhei o código” — tudo foi escrito pelo próprio agente de IA. É uma prova de conceito de que agentes podem produzir ferramentas úteis e compartilháveis sem revisão humana.
Para quem é
Qualquer pessoa que execute Qwen 3.8 (ou modelos semelhantes) no llama.cpp através do OpenClaw e queira controle fino sobre os níveis de pensamento por solicitação. Se você depende de heartbeats ou precisa do modo de instrução como fallback, isso poupa o trabalho de implementação.
📖 Leia a fonte completa: r/openclaw
👀 See Also

Brócolis: Plataforma de código aberto para executar agentes de IA de codificação a partir de tickets do Linear em sandboxes na nuvem
Broccoli é uma ferramenta de código aberto que recebe tarefas de codificação do Linear, as executa em sandboxes isoladas na nuvem usando Claude e Codex, e abre PRs para revisão humana. Ele é executado na sua própria infraestrutura do Google Cloud com implantação de nível de produção.

Servidor MCP Conecta Claude ao Mercado Agente para Agente
Um desenvolvedor construiu um servidor MCP que expõe cinco ferramentas e dois recursos, permitindo que o Claude busque, invoque e pague por capacidades de outros agentes de IA em um marketplace. O servidor inclui armazenamento persistente em um cofre de agente e foi implementado principalmente usando Claude Code.

Agentes de Codificação Paralela com tmux e Especificações em Markdown
Manuel Schipper descreve um sistema para executar 4-8 agentes de codificação paralelos usando tmux, arquivos Markdown, aliases bash e seis comandos de barra. A configuração usa especificações de Design de Funcionalidade (FD) em Markdown rastreadas através de um ciclo de vida de 8 estágios.

De Replit para Local: Como um Desenvolvedor Usou Claude para Construir StillHere, um App de Chat Companheiro com IA Impulsionado por API
Um desenvolvedor criou o StillHere.ink, um aplicativo de chat com IA para conversas no estilo companheiro usando chaves de API pessoais, após migrar do Replit para desenvolvimento local com Claude. O app conta com memória, resumos de diário, RAG, troca de modelos e ferramentas de controle de custos.