当地时间9月23日,谷歌宣布推出Gemini 3.8 Flash TTS和Gemini 3.8 Flash-Lite TTS两款文本转语音模型。前者面向声音和角色设计,支持通过自然语言创建定制声音,并逐句控制语气、语速、口音等;后者面向大规模音频生成和配音场景。谷歌称,两款模型支持超过100种语言和方言,并提供2000多种可直接使用的声音。Flash TTS还支持基于30秒音频样本复制声音。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.