Gemini 3.1 Flash Live: o mais recente modelo de áudio do Google com benchmarks aprimorados e marca d'água

✍️ OpenClawRadar📅 Publicado: March 26, 2026🔗 Source
Gemini 3.1 Flash Live: o mais recente modelo de áudio do Google com benchmarks aprimorados e marca d'água
Ad

O que há de novo no Gemini 3.1 Flash Live

O Google lançou o Gemini 3.1 Flash Live, seu modelo de áudio e voz de mais alta qualidade projetado para diálogo em tempo real. O modelo oferece velocidade aprimorada e ritmo natural para aplicações de IA com foco em voz.

Principais detalhes técnicos

  • Pontuações de benchmark: 90,8% no ComplexFuncBench Audio (chamada de função multi-etapa com restrições) e 36,1% no Audio MultiChallenge da Scale AI (seguimento de instruções complexas com "pensamento" ativado)
  • Capacidades aprimoradas: Melhor compreensão tonal, reconhecimento de nuances acústicas como tom e ritmo, e ajuste dinâmico à frustração ou confusão do usuário
  • Marcação d'água: Todo áudio gerado inclui marca d'água SynthID para detecção de conteúdo de IA
  • Suporte multilíngue: Disponível em mais de 200 países e territórios
Ad

Disponibilidade e acesso

  • Para desenvolvedores: Disponível em prévia via Gemini Live API no Google AI Studio
  • Para empresas: Incluído no Gemini Enterprise for Customer Experience
  • Para usuários em geral: Acessível via Search Live e Gemini Live

O modelo permite a criação de agentes prontos para voz que lidam com tarefas complexas em ambientes ruidosos e suportam conversas mais longas durante interações estendidas.

📖 Read the full source: HN AI Agents

Ad

👀 See Also

GPT-5.5 já disponível no GitHub Copilot com multiplicador premium de 7,5x
News

GPT-5.5 já disponível no GitHub Copilot com multiplicador premium de 7,5x

O GPT-5.5 da OpenAI chega ao GitHub Copilot, oferecendo codificação agente multi-etapas melhorada com um multiplicador promocional de 7,5× para usuários Pro+, Business e Enterprise.

OpenClawRadar
RTX 5080 16GB: Qwen3.6 35B MoE em Contexto de 128k — 56 tok/s, e Por Que o MTP Não Ajuda
News

RTX 5080 16GB: Qwen3.6 35B MoE em Contexto de 128k — 56 tok/s, e Por Que o MTP Não Ajuda

Novos benchmarks mostram que o Qwen3.6 35B MoE na RTX 5080 16GB atinge 56 tok/s de geração com contexto de 128k. O MTP (Multi-Token Prediction) torna-o 23% mais lento devido à pressão de VRAM que empurra camadas de especialistas para a CPU.

OpenClawRadar
Modos de Falha da IA Agêntica e Andaimes de Desenvolvimento
News

Modos de Falha da IA Agêntica e Andaimes de Desenvolvimento

Sistemas de IA agentes falham em produção por meio de desvio de alinhamento, perda de contexto entre transferências, violações de limites e colapso de coordenação. A fonte propõe uma abordagem de 'andaime de desenvolvimento' com cinco componentes: monitoramento de coerência, reparo de coordenação, consciência de consentimento e limites, continuidade relacional e governança adaptativa.

OpenClawRadar
Claude Code v2.1.116: Melhorias de desempenho, correções no terminal e atualizações de segurança
News

Claude Code v2.1.116: Melhorias de desempenho, correções no terminal e atualizações de segurança

O Claude Code v2.1.116 traz melhorias significativas de desempenho, incluindo até 67% mais rápido no comando /resume em sessões de 40MB+, rolagem mais suave no terminal e inicialização mais rápida do MCP. A versão também corrige problemas de renderização do terminal, adiciona proteções de segurança para operações perigosas com caminhos e resolve vários bugs que afetavam comandos de barra e gerenciamento de plugins.

OpenClawRadar