Suno 把语音和背景音乐放在同一条轨道里生成了。这项功能叫 Speech,官方称它是首个把语音与音乐一起生成的音频模型。过去一个月,它只在一小群用户手里测试,现在 beta 版向所有人开放。
这家公司对这件事的定位,写在它自己的表述里:音乐永远是 Suno 的核心,但愿景一直在向其他人类表达形式延伸。Speech 就是这条延伸线上的一步——把一段话、一首诗、一段自己写的东西,变成带原创背景音乐的语音作品。
![]()
怎么用:输入想法,描述声音
Speech 直接内嵌在 Suno 里。操作路径是:输入一个想法、一首诗或者自己写好的内容,然后描述你想要的声音和音乐风格。剩下的交给模型,它输出的是一条完整的、语音和音乐融为一体的音轨。
这个流程里没有分轨,没有先录人声再配乐。语音和背景音乐是一次生成的。
开发过程中,团队自己撞上了不少用法。他们把朋友的短信做成过度制作的戏剧化朗读,给普通的语音备忘录配上不必要地宏大的配乐,还做了冥想、诗歌、打气喊话和给孩子听的睡前故事。
这些用法不是产品设计出来的,是试出来的。官方说,有些让他们笑出声,有些则意外地动人。
它接的是已有的使用习惯
Suno 提到,人们每天都在用它做生日歌、婚礼歌、内部玩笑、信仰与敬拜、给孩子和朋友的歌,以及那些对别人毫无意义、对自己却意味着一切的时刻。Speech 被描述为给这类创作多开了一块画布。
换句话说,它没有要求用户改变创作动机,只是把「说」这件事也纳入了可生成的素材范围。以前你输入的是一个音乐想法,现在你可以输入一段话。
beta 就是 beta
官方对 beta 的定义很直白:偶尔,英国口音会飘到澳大利亚再飘回来;戏剧性的停顿可能会非常戏剧性。他们还说,用户几乎一定会发现连他们自己都没想到的用法——并且明确表示,这就是重点。
接下来,Suno 会继续改进 Speech,依据是人们喜欢什么、什么还不太行、社区接下来想做什么。
把想法变成音乐、故事或艺术,这件事正在变得更容易。Suno 管这叫创意娱乐,并认为它会定义下一波消费科技。Speech 是这家公司在这个判断上押的又一步——只不过这一次,它赌的是你的声音,而不只是你的旋律。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.