当地时间9月23日,谷歌宣布推出Gemini 3.8 Flash TTS和Gemini 3.8 Flash-Lite TTS两款文本转语音模型。前者面向声音和角色设计,支持通过自然语言创建定制声音 ,并逐句控制语气、语速 、口音等;后者面向大规模音频生成和配音场景。谷歌称,两款模型支持超过100种语言和方言,并提供2000多种可直接使用的声音 。Flash TTS还支持基于30秒音频样本复制声音。

(文章来源:界面新闻)
©版权声明
分享是一种美德,转载请保留原链接
THE END
相关推荐





