Plugin Escrito com Claw Adiciona Suporte ao Nível de Pensamento Qwen 3.8 27B ao OpenClaw
Executando Qwen 3.8 27B no llama.cpp com OpenClaw 2026.6.9, mas sem controle nativo do nível de pensamento? Um usuário do OpenClaw encontrou o mesmo problema e deixou seu agente de IA escrever um plugin para corrigi-lo — totalmente gerado, sem teste por olhos humanos.
Por que você precisa deste plugin
O Qwen 3.8 controla os níveis de pensamento via template de chat, em vez de um parâmetro dedicado. O backend llama.cpp do OpenClaw versão 2026.6.9 não mapeia isso por padrão, então os níveis de pensamento são ignorados ou aplicados incorretamente. O plugin preenche essa lacuna.
O que ele faz
- Níveis de pensamento por chamada de API — injeta corretamente o valor
enable_thinkingno template de chat para cada solicitação. - Nível separado para heartbeats — defina um nível de pensamento diferente para chamadas de heartbeat em segundo plano (o autor usa
xhigh). - Modo de instrução (pensamento desativado) — desativa o pensamento e aplica parâmetros de amostragem recomendados pela unsloth para saída ideal.
- Proteção opcional de timeout — força compactação para o modo de instrução para evitar timeouts durante cadeias de raciocínio longas.
Como obter
O plugin está publicado no GitLab:
git clone https://gitlab.com/moltwithhat/llamacpp-qwen-thinking
Nota do autor: “Eu nem olhei o código” — tudo foi escrito pelo próprio agente de IA. É uma prova de conceito de que agentes podem produzir ferramentas úteis e compartilháveis sem revisão humana.
Para quem é
Qualquer pessoa que execute Qwen 3.8 (ou modelos semelhantes) no llama.cpp através do OpenClaw e queira controle fino sobre os níveis de pensamento por solicitação. Se você depende de heartbeats ou precisa do modo de instrução como fallback, isso poupa o trabalho de implementação.
📖 Leia a fonte completa: r/openclaw
👀 See Also

Libretto: Geração Determinística de Automação de Navegador para Agentes de Codificação de IA
Libretto é um kit de ferramentas Skill+CLI que permite que agentes de IA de codificação gerem scripts determinísticos de automação de navegador como código real, afastando-se dos agentes de IA em tempo de execução. Ele combina automação de interface do usuário do Playwright com solicitações diretas de rede/API para confiabilidade e inclui modos de depuração passo a passo e somente leitura.

MCP permite que Claude analise dados do Google Search Console automaticamente
Um novo MCP gratuito conecta Claude diretamente ao Google Search Console, permitindo consultas em linguagem natural sobre dados de desempenho de pesquisa, como consultas, páginas, cliques e CTR, sem necessidade de exportações manuais de CSV.

Infracost reduz o uso de tokens do Claude em 79% ao redesenhar a CLI para agentes de IA
Infracost redesenhou sua CLI para chamadas de agentes de IA, reduzindo os tokens de saída do Claude em 79% e o custo da API em 67% em comparação com uma linha de base apenas com Claude. Principais mudanças: pushdown de predicados na CLI e um formato de saída eficiente em tokens.

GrapeRoot: Ferramenta de código aberto reduz o uso de tokens do Claude Code em 40-80%
GrapeRoot é um servidor MCP local gratuito e de código aberto que fica entre sua base de código e o Claude Code, reduzindo o uso de tokens em 40-80% ao rastrear o que o modelo já viu e enviando apenas as alterações relevantes de código.