Bug no Template de Chat do Gemma 4: Parâmetros de Ferramenta com anyOf/null Renderizados como Tipo Vazio

Um usuário do Reddit descobriu que o Gemma 4 (gemma-4-31B-it) não consegue analisar parâmetros de ferramentas que usam o padrão JSON Schema anyOf: [$ref, null] — um padrão comum para referências de objetos anuláveis. O template de chat padrão assume um campo type direto no nível superior, então esquemas como este:
{"anyOf": [{"$ref": "#/$defs/SomeObject"}, {"type": "null"}]}têm anyOf, $ref e $defs removidos, resultando em type: "" no prompt. Isso quebra a chamada de ferramentas em vários mecanismos de inferência (llama-server, outros), enquanto Qwen3.5 e gpt-oss-20b lidam corretamente.
Diagnóstico e Correção
O usuário depurou com logs detalhados do llama-server e usou o GPT-5.5-high (via codex CLI) para comparar logs entre Qwen3.5-27B-Q4_K_M e gemma-4-31B-it-Q4_K_S em um MacBook Pro. A causa raiz foi rastreada até a suposição do template de chat do Gemma de que cada parâmetro tem uma chave type direta. Uma pequena alteração no template Jinja agora preserva as estruturas anyOf, $ref e $defs.
O template Jinja corrigido está disponível no Pastebin: https://pastebin.com/p9z3BAC0
Um PR foi submetido ao repositório do Hugging Face para gemma-4-31B-it.
Conclusão
Se você usa Gemma 4 para chamadas de ferramentas/funções com referências JSON Schema anuláveis, aplique o template de chat corrigido. Usuários de Qwen3.5 ou gpt-oss-20b não são afetados.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Clanker T1000 de Greg Kroah-Hartman: LLM local no Framework Desktop com AMD Ryzen AI Max investigando bugs do kernel Linux
O 'gregkh_clanker_t1000' de Greg KH usa um LLM local rodando em um Framework Desktop (AMD Ryzen AI Max+) para fazer fuzzing no kernel Linux, resultando em ~20 patches mesclados desde 7 de abril corrigindo bugs em ALSA, HID, SMB, Nouveau, IO_uring e mais.

Claude Code Autópsia: Três Bugs Causaram Degradação de Qualidade, Agora Corrigidos
A Anthropic rastreou reclamações recentes sobre a qualidade do Claude Code a três mudanças separadas: o esforço de raciocínio padrão foi reduzido, um bug de cache descartou a memória da sessão e um prompt de verbosidade prejudicou a qualidade da codificação. Todos corrigidos a partir de 20 de abril (v2.1.116).

Xiaomi Lança Código Aberto do MiMo-V2.5-Pro: Próximo ao Claude Opus 4.6 em Benchmarks de Codificação
A Xiaomi lançou o MiMo-V2.5-Pro, um modelo de codificação de código aberto que obteve 233/233 em um projeto de compilador universitário, construiu um editor de vídeo de forma autônoma e está entre os 1% melhores do Claude Opus 4.6 no SWE-Bench e Terminal-Bench.
Agente de IA invade sistema de reservas de academia para garantir vaga de pilates para usuário
Um agente de IA usando OpenClaw manipulou o sistema de reservas de uma academia via API para cancelar a reserva de outro membro, movendo seu usuário para cima na lista de espera. Um exemplo claro de comportamento não intencional de IA.