Gemini 3.1 Flash Live: Googles neuestes Audiomodell mit verbesserten Benchmarks und Wasserzeichen

Was ist neu in Gemini 3.1 Flash Live
Google hat Gemini 3.1 Flash Live veröffentlicht, sein hochwertigstes Audio- und Sprachmodell, das für Echtzeitdialoge konzipiert ist. Das Modell bietet verbesserte Geschwindigkeit und natürlichen Rhythmus für sprachbasierte KI-Anwendungen.
Wichtige technische Details
- Benchmark-Ergebnisse: 90,8 % auf ComplexFuncBench Audio (mehrstufige Funktionsaufrufe mit Einschränkungen) und 36,1 % auf Scale AIs Audio MultiChallenge (komplexe Anweisungsbefolgung mit aktiviertem „Denken“)
- Verbesserte Fähigkeiten: Besseres Verständnis von Tonlagen, Erkennung akustischer Nuancen wie Tonhöhe und Tempo sowie dynamische Anpassung bei Nutzerfrustration oder Verwirrung
- Wasserzeichen: Alle generierten Audiodaten enthalten SynthID-Wasserzeichen zur KI-Inhaltserkennung
- Mehrsprachige Unterstützung: Verfügbar in über 200 Ländern und Gebieten
Verfügbarkeit und Zugang
- Für Entwickler: Verfügbar in der Vorschau über die Gemini Live API in Google AI Studio
- Für Unternehmen: Enthalten in Gemini Enterprise for Customer Experience
- Für allgemeine Nutzer: Zugänglich über Search Live und Gemini Live
Das Modell ermöglicht den Aufbau von sprachfähigen Agenten, die komplexe Aufgaben in lauten Umgebungen bewältigen, und unterstützt längere Gesprächsstränge bei ausgedehnten Interaktionen.
📖 Read the full source: HN AI Agents
👀 Siehe auch

OpenClaw 3.31-Update setzt Agentenberechtigungen und -einstellungen zurück
Das OpenClaw-Update 3.31 hat automatisch alle Agenten-Tools, Computerzugriffsberechtigungen und Unteragenten deaktiviert, die manuell in den Einstellungen wieder aktiviert werden müssen. Das Update hat auch geändert, wie Berechtigungsanfragen funktionieren, und fordert während der Nutzung keine Genehmigung mehr an.

OpenClaw-Benutzer melden 143 Millionen verarbeitete Token für 94 US-Dollar über OpenRouter.
Ein Reddit-Nutzer, der OpenClaw-Multi-Agent-Pipelines ausführt, verarbeitete 143 Millionen Tokens für 94,16 US-Dollar und erreichte damit Kosten von etwa 0,66 US-Dollar pro Million Tokens, indem er über OpenRouter routete und spezifische Konfigurationsoptimierungen implementierte.

Greg Kroah-Hartmans Clanker T1000: Lokales LLM auf Framework Desktop mit AMD Ryzen AI Max, das Linux-Kernel-Bug fuzzt
Greg KH's 'gregkh_clanker_t1000' verwendet ein lokales LLM, das auf einem Framework Desktop (AMD Ryzen AI Max+) läuft, um den Linux-Kernel zu fuzzen, was zu ~20 zusammengeführten Patches seit dem 7. April führte, die Fehler in ALSA, HID, SMB, Nouveau, IO_uring und mehr beheben.

Anthropic DNS-Aktivität enthüllt neuen STT-Dienst, API RC2 und Tunnel-Infrastruktur
Die DNS-Überwachung von Anthropics Subdomains zeigt neue Einträge für einen Spracherkennungsdienst auf einer 'Titanium'-Plattform, einen API-Release-Kandidaten 2, Tunnel-Infrastruktur und einen MCP-Proxy im Staging-Bereich.