mistral.rs Adiciona Suporte ao Gemma 4 12B: Multimodal, Agentivo e MTP

mistral.rs agora suporta o Gemma 4 12B com recursos multimodais, agentivos e de Previsão Multiturno (MTP). Esta versão inclui pesquisa web e execução de código em ambiente isolado para criar aplicações agentivas, além de entrada de áudio, imagem e vídeo.
Instalação
Instalação em linha única para Linux/macOS e Windows:
# Linux/macOS
curl --proto '=https' --tlsv1.2 -sSf https://raw.githubusercontent.com/EricLBuehler/mistral.rs/master/install.sh | sh
Windows
irm https://raw.githubusercontent.com/EricLBuehler/mistral.rs/master/install.ps1 | iex
Executando com Agent & Quantização
Inicie um servidor HTTP compatível com OpenAI e Anthropic, com uma interface web integrada em localhost:1234/ui:
mistralrs run --agent -m google/gemma-4-12B-it --quant 4Habilitando MTP (Previsão Multiturno)
Para usar o MTP, adicione a flag --mtp-model com o modelo assistente:
mistralrs run --agent -m google/gemma-4-12B-it --quant 4 --mtp-model google/gemma-4-12B-it-assistantPrincipais Recursos
- Suporte multimodal completo: áudio, imagem e vídeo
- Pesquisa web e execução de código em ambiente isolado para fluxos agentivos
- Servidor HTTP compatível com OpenAI e Anthropic
- Interface de chat web integrada em
localhost:1234/ui
Para mais detalhes: GitHub | Documentação
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Claude-Skills Maintainer Solicita Feedback sobre Biblioteca de 181 Habilidades de Agentes
Reza, mantenedor do claude-skills, está pedindo feedback da comunidade sobre sua biblioteca de código aberto que contém 181 habilidades de agentes, 250 ferramentas Python e 15 personas de agentes que funcionam em 11 ferramentas de codificação de IA. Ele está questionando se a abordagem de habilidades isoladas é eficaz e quer opiniões sobre habilidades ausentes, agentes baseados em personas e integrações de ferramentas.

Agente de Codificação Pi com Qwen 35B Q2: Usando Sistema de Arquivos como Memória Externa e Impondo Guardas de Contexto
Um usuário do Reddit construiu uma stack em torno do agente de codificação Pi com Qwen 35B Q2_K_XL quant que impõe guardiões — rejeita edições com mais de 100 linhas, limita blocos de pensamento a 2000 caracteres e monitora o contexto em 65%/80% — tratando o sistema de arquivos como a memória do modelo, não a janela de contexto.

Kreuzberg v4.7.0 adiciona inteligência de código para 248 idiomas e extração aprimorada de markdown
Kreuzberg v4.7.0, uma biblioteca de inteligência de documentos com núcleo em Rust, agora suporta extração de código para 248 formatos via tree-sitter e melhorou significativamente a qualidade do markdown com pontuações Structural F1 acima de 80% em 23 formatos.

Arquitetura de Chat Paralelo Claude para Desenvolvimento Next.js
Um desenvolvedor criou um sistema para executar múltiplos chats do Claude AI simultaneamente na mesma base de código Next.js usando uma tabela de banco de dados compartilhada e um agente de polling, alcançando 87% de taxa de sucesso de build sem conflitos de merge em uma sessão.