Gemini 3.1 Flash Live: o mais recente modelo de áudio do Google com benchmarks aprimorados e marca d'água

O que há de novo no Gemini 3.1 Flash Live
O Google lançou o Gemini 3.1 Flash Live, seu modelo de áudio e voz de mais alta qualidade projetado para diálogo em tempo real. O modelo oferece velocidade aprimorada e ritmo natural para aplicações de IA com foco em voz.
Principais detalhes técnicos
- Pontuações de benchmark: 90,8% no ComplexFuncBench Audio (chamada de função multi-etapa com restrições) e 36,1% no Audio MultiChallenge da Scale AI (seguimento de instruções complexas com "pensamento" ativado)
- Capacidades aprimoradas: Melhor compreensão tonal, reconhecimento de nuances acústicas como tom e ritmo, e ajuste dinâmico à frustração ou confusão do usuário
- Marcação d'água: Todo áudio gerado inclui marca d'água SynthID para detecção de conteúdo de IA
- Suporte multilíngue: Disponível em mais de 200 países e territórios
Disponibilidade e acesso
- Para desenvolvedores: Disponível em prévia via Gemini Live API no Google AI Studio
- Para empresas: Incluído no Gemini Enterprise for Customer Experience
- Para usuários em geral: Acessível via Search Live e Gemini Live
O modelo permite a criação de agentes prontos para voz que lidam com tarefas complexas em ambientes ruidosos e suportam conversas mais longas durante interações estendidas.
📖 Read the full source: HN AI Agents
👀 See Also

GPT-5.5 já disponível no GitHub Copilot com multiplicador premium de 7,5x
O GPT-5.5 da OpenAI chega ao GitHub Copilot, oferecendo codificação agente multi-etapas melhorada com um multiplicador promocional de 7,5× para usuários Pro+, Business e Enterprise.

RTX 5080 16GB: Qwen3.6 35B MoE em Contexto de 128k — 56 tok/s, e Por Que o MTP Não Ajuda
Novos benchmarks mostram que o Qwen3.6 35B MoE na RTX 5080 16GB atinge 56 tok/s de geração com contexto de 128k. O MTP (Multi-Token Prediction) torna-o 23% mais lento devido à pressão de VRAM que empurra camadas de especialistas para a CPU.

Modos de Falha da IA Agêntica e Andaimes de Desenvolvimento
Sistemas de IA agentes falham em produção por meio de desvio de alinhamento, perda de contexto entre transferências, violações de limites e colapso de coordenação. A fonte propõe uma abordagem de 'andaime de desenvolvimento' com cinco componentes: monitoramento de coerência, reparo de coordenação, consciência de consentimento e limites, continuidade relacional e governança adaptativa.

Claude Code v2.1.116: Melhorias de desempenho, correções no terminal e atualizações de segurança
O Claude Code v2.1.116 traz melhorias significativas de desempenho, incluindo até 67% mais rápido no comando /resume em sessões de 40MB+, rolagem mais suave no terminal e inicialização mais rápida do MCP. A versão também corrige problemas de renderização do terminal, adiciona proteções de segurança para operações perigosas com caminhos e resolve vários bugs que afetavam comandos de barra e gerenciamento de plugins.