IT之家 昨天
业界首个:AI音乐制作平台Suno推出Speech语音生成功能
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

IT 之家 10 月 3 日消息,当地时间 10 月 1 日,AI 音乐制作平台 Suno 宣布推出 Speech,Suno 宣称这是业界首个能够将语音与音乐作为单一连贯音轨共同生成的音频模型。

据悉,该模型并非像传统工作流那样先做 TTS(文本转语音)再拼接 BGM,而是端到端一体化生成,是首个能单次生成完整融合 " 语音朗读 + 原创 BGM" 的端到端闭源音频模型。

在过去一个月中,Suno 与小范围用户共同测试了该功能,现在正式面向所有人开放公测(Beta)。

官方表示,通过 Speech,用户可以轻松创作带有 BGM 的语音音频。该功能已直接内置于 Suno 中:只需输入一个灵感、一首诗或一段文字,再描述用户心目中的音色与音乐风格即可。

IT 之家注意到,Suno 官方也指出了当前 Beta 版的不足,当前版本偶发口音不稳定的问题,例如英音可能会在中途漂移到澳音然后又漂回来;语调与情感停顿有时会显得 " 过于戏剧化 ",导致断句节奏过慢。

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

ai it之家 音乐
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论