Suno推出Speech语音功能 端到端生成语音与音乐
AI摘要
由 AI 生成 · 仅供参考
Suno于当地时间10月1日推出Speech语音功能,称其为业界首个端到端共同生成语音与音乐的闭源音频模型,结束小范围测试后面向所有人开放公测,可输入文字和音色、音乐风格描述生成带背景音乐语音音频,但Beta版存在口音不稳定、语调停顿过于戏剧化等问题。
驱动中国10月3日消息,AI音乐制作平台Suno于当地时间10月1日宣布推出Speech语音功能。Suno称,这是业界首个能够将语音与音乐作为单一连贯音轨共同生成的音频模型。
在生成方式上,Speech并非按照传统工作流先进行文本转语音,再拼接背景音乐,而是采用端到端一体化生成。Suno表示,该模型是首个能够单次生成完整融合语音朗读与原创背景音乐的端到端闭源音频模型。
测试与开放方面,Suno在过去一个月中与小范围用户共同测试该功能,现已正式面向所有人开放公测。官方称,通过Speech,用户可以创作带有背景音乐的语音音频。
该功能已直接内置于Suno中。用户只需输入一个灵感、一首诗或一段文字,并描述心目中的音色与音乐风格,即可生成相应音频。
对于当前Beta版存在的不足,Suno官方指出,语音口音偶发不稳定,例如英音可能会在中途漂移到澳音,随后又回到英音;语调与情感停顿有时会显得过于戏剧化,导致断句节奏过慢。
版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系
editor@qudong.com。
来源:驱动中国 · 原文链接:https://www.qudong.com/article/525052.html
本文价值
★★★★★
3
1 人已评
登录后为本文打分
评论加载中…