Plugin Escrito com Claw Adiciona Suporte ao Nível de Pensamento Qwen 3.8 27B ao OpenClaw

✍️ OpenClawRadar📅 Publicado: August 20, 2026🔗 Source
Ad

Executando Qwen 3.8 27B no llama.cpp com OpenClaw 2026.6.9, mas sem controle nativo do nível de pensamento? Um usuário do OpenClaw encontrou o mesmo problema e deixou seu agente de IA escrever um plugin para corrigi-lo — totalmente gerado, sem teste por olhos humanos.

Por que você precisa deste plugin

O Qwen 3.8 controla os níveis de pensamento via template de chat, em vez de um parâmetro dedicado. O backend llama.cpp do OpenClaw versão 2026.6.9 não mapeia isso por padrão, então os níveis de pensamento são ignorados ou aplicados incorretamente. O plugin preenche essa lacuna.

O que ele faz

  • Níveis de pensamento por chamada de API — injeta corretamente o valor enable_thinking no template de chat para cada solicitação.
  • Nível separado para heartbeats — defina um nível de pensamento diferente para chamadas de heartbeat em segundo plano (o autor usa xhigh).
  • Modo de instrução (pensamento desativado) — desativa o pensamento e aplica parâmetros de amostragem recomendados pela unsloth para saída ideal.
  • Proteção opcional de timeout — força compactação para o modo de instrução para evitar timeouts durante cadeias de raciocínio longas.
Ad

Como obter

O plugin está publicado no GitLab:

git clone https://gitlab.com/moltwithhat/llamacpp-qwen-thinking

Nota do autor: “Eu nem olhei o código” — tudo foi escrito pelo próprio agente de IA. É uma prova de conceito de que agentes podem produzir ferramentas úteis e compartilháveis sem revisão humana.

Para quem é

Qualquer pessoa que execute Qwen 3.8 (ou modelos semelhantes) no llama.cpp através do OpenClaw e queira controle fino sobre os níveis de pensamento por solicitação. Se você depende de heartbeats ou precisa do modo de instrução como fallback, isso poupa o trabalho de implementação.

📖 Leia a fonte completa: r/openclaw

Ad

👀 See Also

Libretto: Geração Determinística de Automação de Navegador para Agentes de Codificação de IA
Tools

Libretto: Geração Determinística de Automação de Navegador para Agentes de Codificação de IA

Libretto é um kit de ferramentas Skill+CLI que permite que agentes de IA de codificação gerem scripts determinísticos de automação de navegador como código real, afastando-se dos agentes de IA em tempo de execução. Ele combina automação de interface do usuário do Playwright com solicitações diretas de rede/API para confiabilidade e inclui modos de depuração passo a passo e somente leitura.

OpenClawRadar
MCP permite que Claude analise dados do Google Search Console automaticamente
Tools

MCP permite que Claude analise dados do Google Search Console automaticamente

Um novo MCP gratuito conecta Claude diretamente ao Google Search Console, permitindo consultas em linguagem natural sobre dados de desempenho de pesquisa, como consultas, páginas, cliques e CTR, sem necessidade de exportações manuais de CSV.

OpenClawRadar
Infracost reduz o uso de tokens do Claude em 79% ao redesenhar a CLI para agentes de IA
Tools

Infracost reduz o uso de tokens do Claude em 79% ao redesenhar a CLI para agentes de IA

Infracost redesenhou sua CLI para chamadas de agentes de IA, reduzindo os tokens de saída do Claude em 79% e o custo da API em 67% em comparação com uma linha de base apenas com Claude. Principais mudanças: pushdown de predicados na CLI e um formato de saída eficiente em tokens.

OpenClawRadar
GrapeRoot: Ferramenta de código aberto reduz o uso de tokens do Claude Code em 40-80%
Tools

GrapeRoot: Ferramenta de código aberto reduz o uso de tokens do Claude Code em 40-80%

GrapeRoot é um servidor MCP local gratuito e de código aberto que fica entre sua base de código e o Claude Code, reduzindo o uso de tokens em 40-80% ao rastrear o que o modelo já viu e enviando apenas as alterações relevantes de código.

OpenClawRadar