Suno上线Speech:语音与配乐一次生成
报价宝综合消息Suno上线Speech:语音与配乐一次生成

以AI音乐生成起家的Suno开始把触角伸向"说话"。这家公司推出Speech功能的公开测试版,覆盖网页端和移动端:用户输入剧本或描述性提示词即可生成配音,平台还能同步生成背景音乐,与语音合成一条完整的音轨。
"音乐永远都是Suno的核心和我们构建的东西,但我们的愿景从一开始就延伸到其他形式的人类表达,"Suno首席产品官杰克·布罗迪(Jack Brody)在公告中称,Speech是"第一个把语音和音乐作为一个完整音轨一起生成的音频模型"。
用法分两档:Simple模式适合随口描述,比如"一个海盗船长在动员他的船员";Advanced模式可粘贴完整台词,并调整音色、性别等参数。背景音乐是可选项,只想要干净人声的用户一键关闭即可。官方设想的场景包括给诗歌配舒缓的背景乐,为励志演讲或戏剧旁白配更有能量的节奏。
AI语音合成并不新鲜——DeepMind十年前就在做深度学习语音合成,Adobe有现成的文字转语音工具,ElevenLabs更是2023年上线以来最出圈的玩家。Suno此时入场,外界普遍解读为给平台增加多元化筹码:它的音乐生成器背上的版权官司一只手都数不过来。
公司自己也不掩饰产品的半成品状态。"测试版就是真的测试版,"布罗迪说,"偶尔英国口音会跑到澳大利亚再跑回来,戏剧性停顿可能真的很有戏剧性。你几乎一定会发现一些我们自己都想不到的用法。"后续改进将围绕用户反馈持续进行。
编译自 The Verge,原标题:"AI music maker Suno now generates spoken words"