Os modelos Qwen3.x falham silenciosamente no OpenClaw devido a incompatibilidade no formato de saída de streaming.

O Problema
Ao executar modelos Qwen3.x localmente com OpenClaw no modo de streaming, os modelos enviam suas respostas para o campo reasoning em vez do campo esperado content. O OpenClaw interpreta o conteúdo vazio como uma falha e silenciosamente recorre ao próximo modelo na sua cadeia de fallback sem lançar um erro. Isso resulta no modelo errado respondendo às consultas.
A Solução
A correção envolve implementar um pequeno proxy que fica entre o OpenClaw e o Ollama. Este proxy executa duas funções principais:
- Traduz o formato da API entre os dois sistemas
- Injeta
think: falseno local apropriado
Uma vez configurado corretamente, os modelos Qwen3.x passam na avaliação completa de chamadas de ferramentas com pontuação perfeita (15/15), incluindo execução, leitura de arquivos, busca na web, integração com Sheets, integração com Slack e operações de memória.
Detalhes da Implementação
A fonte fornece uma descrição abrangente que cobre:
- Instruções de configuração do proxy
- Seis configurações específicas que devem estar todas corretas
- Abordagens de monitoramento
- O que não funciona (armadilhas comuns a evitar)
Os detalhes técnicos completos, incluindo trechos de código e exemplos de configuração, estão disponíveis no gist vinculado.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Revisão Prática: 3 Habilidades Essenciais do Clawhub e 3 para Evitar
Um desenvolvedor testou as habilidades do Clawhub por semanas e encontrou três que valem a pena instalar: web-search (Brave), daily-brief e memory-search. Outras três — food-order, orquestradores multiagente e humanizer — desperdiçam tokens e adicionam complexidade desnecessária.
Automatizando Atualizações do OpenClaw com um Agente de IA: Um Manual Testado em Campo
Um desenvolvedor conta como treinou um agente Hermes de IA para lidar com atualizações do OpenClaw, reduzindo uma migração de várias horas e cheia de tensão para "rodar o playbook, encontrar dois problemas conhecidos".

Corrigindo a Invalidação do Cache KV do Claude Code com Backends Locais
As versões 2.1.36+ do Claude Code injetam cabeçalhos de telemetria dinâmica e atualizações de status do git em cada solicitação, quebrando a correspondência de prefixos e forçando o reprocessamento completo do prompt do sistema com mais de 20 mil tokens em backends locais como o llama.cpp. Uma correção de configuração em ~/.claude/settings.json pode reduzir o processamento de mais de 60 segundos para aproximadamente 4 segundos.

Tratar os Subagentes do OpenClaw como Funções Sem Estado em vez de Membros Persistentes da Equipe
Um desenvolvedor compartilha sua experiência ao mudar de tratar subagentes do OpenClaw como membros persistentes da equipe com personalidades para vê-los como chamadas de função stateless com propósitos especializados.