Gemini 3.1 Flash Live: Googles neuestes Audiomodell mit verbesserten Benchmarks und Wasserzeichen

✍️ OpenClawRadar📅 Veröffentlicht: 26. März 2026🔗 Source
Gemini 3.1 Flash Live: Googles neuestes Audiomodell mit verbesserten Benchmarks und Wasserzeichen
Ad

Was ist neu in Gemini 3.1 Flash Live

Google hat Gemini 3.1 Flash Live veröffentlicht, sein hochwertigstes Audio- und Sprachmodell, das für Echtzeitdialoge konzipiert ist. Das Modell bietet verbesserte Geschwindigkeit und natürlichen Rhythmus für sprachbasierte KI-Anwendungen.

Wichtige technische Details

  • Benchmark-Ergebnisse: 90,8 % auf ComplexFuncBench Audio (mehrstufige Funktionsaufrufe mit Einschränkungen) und 36,1 % auf Scale AIs Audio MultiChallenge (komplexe Anweisungsbefolgung mit aktiviertem „Denken“)
  • Verbesserte Fähigkeiten: Besseres Verständnis von Tonlagen, Erkennung akustischer Nuancen wie Tonhöhe und Tempo sowie dynamische Anpassung bei Nutzerfrustration oder Verwirrung
  • Wasserzeichen: Alle generierten Audiodaten enthalten SynthID-Wasserzeichen zur KI-Inhaltserkennung
  • Mehrsprachige Unterstützung: Verfügbar in über 200 Ländern und Gebieten
Ad

Verfügbarkeit und Zugang

  • Für Entwickler: Verfügbar in der Vorschau über die Gemini Live API in Google AI Studio
  • Für Unternehmen: Enthalten in Gemini Enterprise for Customer Experience
  • Für allgemeine Nutzer: Zugänglich über Search Live und Gemini Live

Das Modell ermöglicht den Aufbau von sprachfähigen Agenten, die komplexe Aufgaben in lauten Umgebungen bewältigen, und unterstützt längere Gesprächsstränge bei ausgedehnten Interaktionen.

📖 Read the full source: HN AI Agents

Ad

👀 Siehe auch