Estado do Open Source AI da Mozilla: 3% de diferença de desempenho, redução de 50x nos custos, adoção por 79% dos desenvolvedores

A Mozilla publicou seu primeiro relatório State of Open Source AI, baseado em uma pesquisa global com mais de 950 desenvolvedores. A manchete: os modelos abertos praticamente fecharam a lacuna de desempenho com sistemas proprietários como ChatGPT e Claude, agora ficando apenas 3% atrás, enquanto os custos caíram até 50x em três anos. Mas o relatório alerta que a IA open source ainda captura apenas 4% da receita, apesar de alimentar cerca de um terço do uso real de IA no mundo.
Principais Descobertas
- Lacuna de desempenho reduzida: Modelos abertos agora têm desempenho dentro de 3% dos melhores modelos fechados.
- Vantagem de custo: Os custos caíram até 50x em três anos.
- Adoção vs. implantação: 79% dos desenvolvedores usam modelos abertos, mas apenas 51% os implantaram em produção (vs. 63% para modelos fechados). Essa lacuna persiste independentemente do tamanho da empresa, indicando falta de ferramentas e suporte maduros.
- Licenciamento e propriedade importam: Os compradores priorizam termos de licença (31%) e propriedade (26%) sobre capacidade bruta.
- Mudança geopolítica: China e Leste Asiático lideram a adoção de IA open source com 89%, muito à frente do Ocidente. 12 novas estratégias nacionais de IA foram lançadas no ano passado; 47 países agora restringem o processamento estrangeiro para cargas de trabalho críticas.
- O harness agêntico é o novo campo de batalha: A camada de software entre usuários e modelos (o que a IA pode ver, lembrar, fazer) agora importa mais do que o próprio modelo. Mudar essa camada pode afetar o desempenho mais do que trocar o modelo.
- Fadiga de consentimento: Os usuários aprovam solicitações de agentes de IA por padrão até 93% das vezes, com salvaguardas em grande parte ausentes.
Quem Deve Ler Isso
CTOs, formuladores de políticas, desenvolvedores e investidores que buscam entender o estado atual da IA open source e suas implicações estratégicas.
O CTO da Mozilla, Raffi Krikorian, enfatiza: "A IA open source atingiu um ponto de virada... Não se trata mais de expandir o acesso aos modelos; trata-se de quem tem o poder de moldar, auditar e melhorá-los." O relatório defende o investimento em infraestrutura, ferramentas e governança para evitar um bloqueio de IA fechada e restritiva.
Leia o relatório completo no blog da Mozilla.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

O benchmark mostra que o modelo menor de 4B supera LLMs maiores em aplicações de chat telefone-casa.
Um benchmark de 8 LLMs locais para aplicações de chat telefone-para-casa descobriu que o Gemma3:4B venceu com uma pontuação de aptidão composta de 88,7, apesar de ser o menor modelo, superando modelos maiores com até 24B de parâmetros devido a tempos de resposta mais rápidos e menor carga térmica.

Estratégia de IA da Apple e a Commoditização da Inteligência
O artigo argumenta que a abordagem conservadora da Apple em relação à IA pode ser vantajosa à medida que a inteligência se torna uma commodity, com modelos como o Gemma4 alcançando 85,2% no MMLU Pro enquanto rodam em telefones, e o Sora da OpenAI custando US$ 15 milhões diários contra uma receita de US$ 2,1 milhões.

Claude Code v2.1.146: Comando /code-review, Correção de Paginação, Correção do Windows PowerShell
Claude Code v2.1.146 renomeia /simplify para /code-review com nível de esforço opcional, corrige paginação MCP e ferramenta PowerShell do Windows, melhora confiabilidade do auto-updater e desempenho de renderização de diffs.

Qwen3.5-122B-A10B-MINT-MLX funciona perfeitamente no M5 Pro com 64 GB de RAM.
Um usuário relata a implantação local bem-sucedida do modelo Qwen3.5-122B-A10B-MINT-MLX em um M5 Pro com 64GB de RAM, alcançando velocidade de geração de 39,58 tokens/seg com comandos específicos de alocação de VRAM.