구글, 제미니 3.8 텍스트-음성 변환 모델 공개

Key Point
자연어만으로 완전히 새로운 음성 캐릭터를 만들 수 있고, 음성 복제 기능과 명확한 동의 검증 체계로 창작자와 음성 크리에이터를 보호하면서도 대규모 다국어 콘텐츠 제작을 가능하게 한다.
핵심 요약
- 구글이 Gemini 3.8 Flash TTS와 Gemini 3.8 Flash-Lite TTS 두 개의 새로운 텍스트-음성 변환 모델을 발표했다.
- Gemini 3.8 Flash TTS는 자연어 프롬프트로 완전히 새로운 음성을 창작하는 창의적 용도에, Gemini 3.8 Flash-Lite TTS는 대규모 더빙과 음성 에이전트에 최적화되어 있다.
- 사용자는 30초의 음성 샘플로부터 일관된 음성 프로필을 복제할 수 있으며, 음성 소유자의 명시적 동의 녹음을 통해 동의 검증이 이루어진다.