前段时间跟大家介绍过一个很不一样的文字转语音项目Bark,它的特点是不仅可以生成逼真的说话声,还可以生成笑声,叹息,清嗓等等人类自然交谈时发出的声音,以前的AI语音再逼真也可以识别,但Bark模型生成的语音几乎可以以假乱真了。两个多月前Bark刚在github上发布时我填过一个Suno Studio抢先体验的邮箱申请,昨晚收到了Suno的来信,现在可以在他们的Discord服务器中使用语音生成以及歌曲创作了!
来到discord试用,他们果然没有让人失望,文字转语音的效果已经很惊人了,居然还能生成歌曲,并且一问世就是目前市面上最厉害的,真是重大惊喜呀!
这里的歌曲生成很简单,输入命令,贴入歌词,两分钟后就会有歌手为你唱出来,歌手目前是随机分配的,歌曲形式,旋律,风格什么的也都是随机分配,不过都好听!suno的这个唱歌模型和以前我分享过的几个歌曲生成模型最大的区别是,它生成的歌曲类型非常丰富,歌手的嗓音也很有温度,且很有演唱技巧,听了大家生成的一些片断,很多歌都令人耳目一新,绝不会重复或者单调。
歌曲每次最多只能生成30秒,不过可以接着前一首继续生成,我试着接了五次都没问题,风格全部可以保持一致,虽然现在还做不到无缝衔接,不过我觉得已经是了不起的成就啦。
目前中文还不太支持,文字转语音bark命令下的声音不认识中文,里面的joke, poem命令有一个language选项,我输入Chinese倒是可以读出来的,也很流利,不过是带着外国人口音的。歌曲生成这边也是不认识中文,输入中文就只有音乐生成出来,但是音乐无国界嘛,语言不是大问题,英文也可以玩起来。
加入链接
命令参考
https://suno-ai.notion.site/Getting-Started-bd910edceea64cadb91954aa08bc0603