구글이 차세대 TTS(Text-to-Speech) 모델 Gemini 3.1 Flash TTS를 공개했다. Artificial Analysis TTS 리더보드에서 Elo 1,211로 최상위, 70+ 언어 지원, 네이티브 멀티 스피커 대화, 오디오 태그로 말투·속도·딜리버리를 자연어 명령으로 정밀 제어 가능. 개발자용 Gemini API/AI Studio, 기업용 Vertex AI, Workspace Google Vids에 프리뷰 배포. AI 생성물임을 표시하는 히든 워터마크 포함.
- •Gemini 3.1 Flash TTS 공개 — 70+ 언어 지원, Artificial Analysis Elo 1,211
- •오디오 태그로 말투·속도·딜리버리를 자연어로 정밀 제어
- •네이티브 멀티 스피커 대화 생성 지원
- •Gemini API/AI Studio, Vertex AI, Google Vids에 프리뷰 배포
- •AI 생성물 표시를 위한 히든 워터마크 내장
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Gemini 3.1 Flash TTS: the next generation of expressive AI speech
- 1.구글 Gemini 3.1 Flash TTS로 AI 음성 품질·제어성 강화
- 2.오디오 태그 기반 정밀 제어가 새 차별화 포인트
- 3.AI 음성 생성의 워터마크 내장으로 악용 방지
왜 중요한가?
AI 음성 생성이 컨텐츠 제작·교육·고객 서비스 전반으로 퍼지는 상황에서 제어성과 워터마크가 상용 필수 요건으로 자리잡음. ElevenLabs 등 기존 리더와의 경쟁 격화.
본문 미리보기
Our newest audio model introduces granular audio tags that give you precise control to direct AI speech for expressive audio generation.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 19:43AI 초안

