Bugs no analisador do LM Studio quebram a chamada de ferramentas e o raciocínio do Qwen3.5

✍️ OpenClawRadar📅 Publicado: March 2, 2026🔗 Source
Bugs no analisador do LM Studio quebram a chamada de ferramentas e o raciocínio do Qwen3.5
Ad

Problemas do analisador do LM Studio afetando modelos de raciocínio

O analisador do servidor do LM Studio contém múltiplos bugs que interferem na chamada de ferramentas e no raciocínio em modelos como Qwen3.5 e DeepSeek-R1. Esses problemas podem fazer os modelos parecerem quebrados quando o problema está realmente no analisador.

Os bugs

1. O analisador procura padrões de chamada de ferramentas dentro dos blocos <think>

Quando modelos de raciocínio pensam sobre a sintaxe de chamada de ferramentas dentro de seus blocos <think>, o analisador do LM Studio trata essas menções em prosa como tentativas reais de chamada de ferramentas. Isso cria uma armadilha recursiva onde o modelo raciocina sobre chamadas de ferramentas, o analisador encontra tokens com formato de chamada de ferramentas no pensamento, a análise falha, o erro é alimentado de volta ao modelo e o ciclo se repete.

O modelo literalmente não consegue depurar um problema de chamada de ferramentas porque descrever o problema o reproduz. Um modelo disse explicitamente "Estou preso em um loop onde meus pensamentos sobre a sintaxe de chamada de ferramentas estão sendo interpretados como marcadores reais de chamada de ferramentas" — e essa própria frase acionou o analisador.

Isso foi relatado pela primeira vez como issue #453 em fevereiro de 2025 e permanece aberto mais de um ano depois.

Solução alternativa: Desative o raciocínio com {%- set enable_thinking = false %}. Isso corrige instantaneamente o problema, permitindo que 20+ chamadas de ferramentas consecutivas tenham sucesso.

2. Registrar um segundo servidor MCP quebra a análise de chamada de ferramentas do primeiro

Este bug é limpo e determinístico. Testes com lfm2-24b-a2b em temperatura=0.0 mostram:

  • Apenas servidor KG ativo: O modelo chama corretamente search_nodes, o analisador reconhece tokens <|tool_call_start|>, a ferramenta é executada, resultados retornados. Funciona perfeitamente.
  • Adicione servidor webfetch (nem mesmo o chame): O modelo emite <|tool_call_start|>[web_search(...)]<|tool_call_end|> como texto bruto no chat. Os tokens especiais não são mais reconhecidos. A ferramenta nunca é executada.

A mera inscrição de um segundo servidor MCP — sem chamá-lo — muda como o analisador lida com as chamadas de ferramentas do primeiro servidor. Mesmo modelo, mesmo prompt, mesmo servidor alvo. Apenas uma variável mudou.

Solução alternativa: Registre apenas o servidor MCP que você precisa para cada tarefa. Isso é impraticável para fluxos de trabalho agentivos.

3. A divisão reasoning_content/content do lado do servidor produz respostas vazias que relatam sucesso

Isso afeta todos que usam modelos de raciocínio via API, usando ou não chamada de ferramentas. Ao enviar um prompt simples para Qwen3.5-35b-a3b via /v1/chat/completions pedindo para listar tags XML usadas para raciocínio, o servidor retornou:

{
  "content": "",
  "reasoning_content": "[3099 tokens de deliberação detalhada]",
  "finish_reason": "stop"
}

O modelo fez um trabalho extenso — 3099 tokens de raciocínio — mas ficou preso em um loop de deliberação dentro de <think> e nunca produziu saída no campo content. O servidor retornou finish_reason: "stop" com conteúdo vazio, relatando sucesso.

Isso significa:

  • Toda suíte de avaliação verificando finish_reason == "stop" aceita silenciosamente respostas vazias
  • Toda estrutura agentiva propaga strings vazias para o próximo passo
  • Todo usuário vê uma resposta em branco e conclui que o modelo está quebrado
  • O raciocínio real está preso em reasoning_content — o modelo fez trabalho real que ninguém vê a menos que verifique explicitamente esse campo

Isso é do lado do servidor, não um bug de UI, confirmado pela inspeção da resposta bruta da API e do log do servidor do LM Studio. A divisão reasoning_content/content acontece antes que a resposta alcance qualquer cliente.

Ad

Interação dos bugs

Esses não são problemas independentes. Eles interagem para criar problemas sistêmicos com chamada de ferramentas e raciocínio no LM Studio.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

motif MCP confere ao Claude Code capacidade de assistir vídeos para reprodução de bugs de UI
Tools

motif MCP confere ao Claude Code capacidade de assistir vídeos para reprodução de bugs de UI

motif é um servidor MCP que permite ao Claude Code assistir a gravações de tela de bugs de UI, usando análise quadro a quadro do Gemini 2.5 Flash para retornar descrições visuais, causas raiz e diffs. A configuração requer uma chave de API Gemini e duas linhas no mcp.json.

OpenClawRadar
Design Aberto: Alternativa Open-Source ao Claude Design Roda em Seus Agentes CLI Locais
Tools

Design Aberto: Alternativa Open-Source ao Claude Design Roda em Seus Agentes CLI Locais

Open Design é um motor de design local-first e BYOK que transforma 11 CLIs de agentes de codificação (Claude Code, Codex, Cursor, Gemini CLI, etc.) em um fluxo de trabalho de design com 72 sistemas de design de nível profissional e 31 habilidades componíveis, exportando HTML/PDF/PPTX/MP4.

OpenClawRadar
quorum: Ferramenta de Governança de Código com IA Aplica Revisão Independente de Modelos
Tools

quorum: Ferramenta de Governança de Código com IA Aplica Revisão Independente de Modelos

quorum é uma camada de governança para desenvolvimento assistido por IA que aplica um protocolo de consenso exigindo que o código seja revisado de forma independente por um modelo diferente antes de ser confirmado. Inclui três portões estruturais que bloqueiam o progresso: portões de auditoria, retrospectiva e qualidade.

OpenClawRadar
Habilidade de código aberto do Claude para estruturas de consultoria de gestão e estudos de caso
Tools

Habilidade de código aberto do Claude para estruturas de consultoria de gestão e estudos de caso

Uma habilidade gratuita do Claude, licenciada pelo MIT, fornece material de referência estruturado para trabalhos de consultoria de gestão, incluindo frameworks, contexto do setor e estudos de caso. O projeto consiste em mais de 80 arquivos markdown organizados por domínio e busca contribuidores para expandir a cobertura.

OpenClawRadar