2026年9月23日,谷歌宣布推出Gemini 3.8 Flash TTS和Flash-Lite TTS两款文本转语音模型。前者面向深度创意与角色设计,支持自然语言生成定制语音;后者侧重高性价比大规模应用。二者均支持100多种语言、精细控制音调节奏,并具备语音复制、混音及双声音编排能力。模型已上线Google AI Studio和Gemini API,企业版将通过Gemini Enterprise推出。所有生成音频嵌入SynthID水印并需语音所有者授权,保障内容可追溯与身份尊重。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。



