제미니 3.1 플래시 라이브: 향상된 벤치마크와 워터마킹 기능을 갖춘 구글의 최신 오디오 모델

Ad
Gemini 3.1 Flash Live의 새로운 점
구글은 실시간 대화를 위해 설계된 최고 품질의 오디오 및 음성 모델인 Gemini 3.1 Flash Live를 출시했습니다. 이 모델은 음성 중심 AI 애플리케이션을 위해 향상된 속도와 자연스러운 리듬을 제공합니다.
주요 기술 사항
- 벤치마크 점수: ComplexFuncBench Audio(제약 조건이 있는 다단계 함수 호출)에서 90.8%, Scale AI의 Audio MultiChallenge(복잡한 지시 사항을 '생각하며' 따르기)에서 36.1%
- 향상된 기능: 더 나은 음조 이해, 피치와 속도 같은 음향적 뉘앙스 인식, 사용자의 좌절감이나 혼란에 대한 동적 조정
- 워터마킹: 생성된 모든 오디오에는 AI 콘텐츠 감지를 위한 SynthID 워터마크가 포함됨
- 다국어 지원: 200개 이상의 국가 및 지역에서 이용 가능
이용 가능성 및 접근성
- 개발자용: Google AI Studio의 Gemini Live API를 통해 미리보기로 이용 가능
- 기업용: Gemini Enterprise for Customer Experience에 포함됨
- 일반 사용자용: Search Live와 Gemini Live를 통해 접근 가능
이 모델은 시끄러운 환경에서 복잡한 작업을 처리하는 음성 준비 에이전트 구축을 가능하게 하며, 장시간 상호작용 중 더 긴 대화 스레드를 지원합니다.
📖 Read the full source: HN AI Agents
Ad
👀 See Also

News
Anthropic, 클로드 제한을 늘리고 SpaceX 컴퓨팅 용량 추가
Anthropic이 Claude 사용 한도를 늘리고 SpaceX와 컴퓨팅 계약을 체결했습니다. Reddit 토론에서는 이것이 단순한 인프라 확장인지, 아니면 Claude를 에이전트 작업에 더 적합한 플랫폼으로 만들기 위한 전략적 움직임인지 논의하고 있습니다.
OpenClawRadar

News
코딩 에이전트가 인간 코드 리뷰를 대체하다: 논문, 기존 리뷰 방식은 죽었다고 주장
arXiv 논문은 코딩 에이전트가 인간 코드 리뷰를 대체할 임계점을 넘었으며, LLM 기반 자율 시스템으로 더 낮은 비용과 더 높은 처리량을 제공한다고 주장합니다.
OpenClawRadar

News
클로드 코드 v2.1.91 업데이트: 에이전트 디자인 패턴, 메모리 규칙 및 도구 개선
Claude Code v2.1.91는 도구 표면 설계, 컨텍스트 관리, 캐싱 전략을 다루는 에이전트 디자인 패턴 참조 가이드를 추가했습니다. 이 업데이트는 메모리 선택 규칙을 단순화하고, 메모리 중독에 대한 보안 모니터링을 추가하며, Edit, ReadFile, Write 작업에 대한 도구 설명을 개선했습니다.
OpenClawRadar
🦀
News
클로드 상태: 모든 모델에서 오류 증가 – 해결됨
2026년 7월 29일 19:45 UTC부터 21:26 UTC까지 클로드가 모든 모델에서 높은 오류율을 경험했습니다. 문제는 해결되었지만 모니터링은 계속됩니다.
OpenClawRadar