Gemini 3.1 Flash Live: o mais recente modelo de áudio do Google com benchmarks aprimorados e marca d'água

O que há de novo no Gemini 3.1 Flash Live
O Google lançou o Gemini 3.1 Flash Live, seu modelo de áudio e voz de mais alta qualidade projetado para diálogo em tempo real. O modelo oferece velocidade aprimorada e ritmo natural para aplicações de IA com foco em voz.
Principais detalhes técnicos
- Pontuações de benchmark: 90,8% no ComplexFuncBench Audio (chamada de função multi-etapa com restrições) e 36,1% no Audio MultiChallenge da Scale AI (seguimento de instruções complexas com "pensamento" ativado)
- Capacidades aprimoradas: Melhor compreensão tonal, reconhecimento de nuances acústicas como tom e ritmo, e ajuste dinâmico à frustração ou confusão do usuário
- Marcação d'água: Todo áudio gerado inclui marca d'água SynthID para detecção de conteúdo de IA
- Suporte multilíngue: Disponível em mais de 200 países e territórios
Disponibilidade e acesso
- Para desenvolvedores: Disponível em prévia via Gemini Live API no Google AI Studio
- Para empresas: Incluído no Gemini Enterprise for Customer Experience
- Para usuários em geral: Acessível via Search Live e Gemini Live
O modelo permite a criação de agentes prontos para voz que lidam com tarefas complexas em ambientes ruidosos e suportam conversas mais longas durante interações estendidas.
📖 Read the full source: HN AI Agents
👀 See Also

Análise do Goldman Sachs Mostra Impacto Mínimo da IA no Crescimento do PIB dos EUA em 2025
Economistas do Goldman Sachs relatam que o investimento em IA contribuiu com 'basicamente zero' para o crescimento do PIB dos EUA em 2025, citando hardware importado e impactos de produtividade não medidos como fatores-chave.

Perda Persistente de Dados em Projetos Claude: Conversas Desaparecendo Sem Recuperação
Um escritor de textos longos relata perder dias inteiros de trabalho em Projetos Claude devido a conversas desaparecerem da lista de bate-papo do projeto, impossíveis de pesquisar e recuperar, sem resposta do suporte da Anthropic após três incidentes.

Cartão de Modelo do Claude Opus 4.7 Lançado
A Anthropic publicou a ficha técnica do modelo Claude Opus 4.7, fornecendo documentação técnica para seu mais recente modelo de IA. O material de origem parece ser um documento PDF contendo especificações do sistema e detalhes técnicos.

O Claude Code adiciona modo de voz para comandos de programação sem uso das mãos.
A Anthropic está lançando o modo de voz para o Claude Code, seu assistente de programação com IA, permitindo que desenvolvedores interajam por meio de comandos de voz. O recurso está atualmente disponível para cerca de 5% dos usuários, com uma disponibilidade mais ampla planejada para as próximas semanas.