当地时间9月23日,谷歌正式发布两款文本转语音AI模型:Gemini 3.8 Flash TTS与Gemini 3.8 Flash-Lite TTS。两款产品定位清晰互补:Flash版专为虚拟角色开发与定制音色设计,用户只需输入自然语言指令即可生成专属声音,并能逐句精准调节语气、语速和口音;同时,该版本支持仅用30秒音频样本即可还原并克隆目标声音。Lite版则主要面向海量音频批量生产与专业配音场景,侧重高效产出。谷歌表示,两大模型均覆盖100多种语言及方言,内置了2000多款开箱即用的现成音色,能显著降低高质量语音合成的使用门槛。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
相关文章
暂无评论...




