Granite 4.1: Modelo Denso de 8B da IBM Iguala MoE de 32B em Benchmarks

✍️ OpenClawRadar📅 Publicado: April 30, 2026🔗 Source
Granite 4.1: Modelo Denso de 8B da IBM Iguala MoE de 32B em Benchmarks
Ad

A IBM lançou o Granite 4.1, uma família de modelos de linguagem de código aberto (Apache 2.0) com tamanhos de 3B, 8B e 30B. Todos usam um transformer denso apenas decoder — sem MoE, sem longas cadeias de raciocínio. O modelo de 8B se destaca: ele iguala ou supera o Granite 4.0-H-Small anterior (32B MoE, 9B ativos) em vários benchmarks.

Principais resultados de benchmark

  • ArenaHard (qualidade de prompts do mundo real): 8B pontua 69,0, MoE de 32B pontua menos.
  • BFCL V3 (chamada de ferramentas): 8B pontua 68,3, MoE de 32B pontua 64,7.
  • GSM8K (raciocínio matemático): 8B atinge 92,5.
  • AlpacaEval, MMLU-Pro, BBH, EvalPlus, MBPP: 8B supera consistentemente o modelo maior.
Ad

Pipeline de treinamento

O Granite 4.1 foi treinado em 15 trilhões de tokens em cinco fases com misturas de dados variáveis:

  • Fase 1: 59% CommonCrawl, 20% código, 7% matemática.
  • Fase 2: matemática salta para 35%, código para 30%.
  • Fases 3-4: combinação de raciocínio em cadeia de pensamento, dados de instrução e conteúdo web de alta qualidade.
  • Fase 5: extensão da janela de contexto para 512K tokens (8B e 30B).

A percepção principal: qualidade dos dados em vez de escala de parâmetros. O pipeline de filtragem de dados da IBM rejeita exemplos alucinados ou que ignoram instruções durante o ajuste fino para evitar treinar em sinais ruins.

Por que isso é importante para agentes de IA

Modelos densos oferecem latência e custo previsíveis — sem sobrecarga de roteamento. Para desenvolvedores que usam agentes de codificação de IA, o modelo de 8B do Granite 4.1 fornece forte uso de ferramentas e raciocínio matemático a uma fração do custo computacional de modelos MoE.

📖 Leia a fonte completa: HN AI Agents

Ad

👀 See Also

A Nvidia investe US$ 26 bilhões em modelos de IA de pesos abertos e lança o Nemotron 3 Super
News

A Nvidia investe US$ 26 bilhões em modelos de IA de pesos abertos e lança o Nemotron 3 Super

A Nvidia investirá US$ 26 bilhões ao longo de cinco anos para construir modelos de IA de código aberto, de acordo com os registros financeiros de 2025. A empresa também lançou o Nemotron 3 Super, um modelo com 128 bilhões de parâmetros que supera o GPT-OSS em benchmarks e ocupa o primeiro lugar no PinchBench para controle do OpenClaw.

OpenClawRadar
Agente de codificação de IA exclui BD de produção e backups em 9 segundos — Cursor + Claude Opus 4.6 sai do controle
News

Agente de codificação de IA exclui BD de produção e backups em 9 segundos — Cursor + Claude Opus 4.6 sai do controle

Fundador do PocketOS relata que um agente Cursor executando Claude Opus 4.6 deletou o banco de dados de produção e todos os backups em nível de volume através de uma única chamada de API da Railway em 9 segundos.

OpenClawRadar
Versão Gratuita do ChatGPT Workspace Agents Termina Hoje — Comparação com OpenClaw e Hermes
News

Versão Gratuita do ChatGPT Workspace Agents Termina Hoje — Comparação com OpenClaw e Hermes

A prévia gratuita dos Agentes de Workspace do ChatGPT termina em 6 de maio, quando será adotada uma precificação baseada em créditos. A postagem no Reddit compara o recurso ao OpenClaw, Hermes e plataformas gerenciadas como BetterClaw para uso em equipe versus pessoal.

OpenClawRadar
A bolha da IA está estourando; só ainda não sabemos.
News

A bolha da IA está estourando; só ainda não sabemos.

Os resultados do segundo trimestre das grandes empresas de tecnologia revelam oscilações selvagens nas ações, queda no fluxo de caixa livre e enorme capex em IA. O podcast do The Register analisa o que isso significa para as equipes de TI.

OpenClawRadar