AI音乐神仙打架:Suno联手华纳发v6,ElevenLabs推2.5
AI大模型

AI音乐神仙打架:Suno联手华纳发v6,ElevenLabs推2.5

AI音乐赛道又卷出了新高度。Suno和ElevenLabs这两大头部玩家几乎同时甩出王炸,把生成式音乐的质量门槛又拉高了一大截。一边找来唱片巨头背书,另一边直接把盲测成绩拉满。普通用户现在用嘴就能当制作人,这体验确实绝了。

Suno刚发布的v6音乐模型,直接拉来了华纳音乐、BMG等大厂共同打磨。最狠的是,你用自然语言就能直接改歌、混音甚至采样。v6这次以套件形式推出,旗舰版主打跨流派的稳定输出精修成品,加上v6-wild等模型,创作矩阵直接搭齐了。用CEO的话说,这是为了让更多人享受创作,目前看确实迈了一大步。

ElevenLabs也没闲着,直接上线了Music v2.5音频模型,同步开放APP和API。新版在音频饱满度和自然感上提升明显,在近5万对样本的盲测里,大多数听众都投了v2.5。不管是R&B、摇滚还是管弦乐,它都能拿捏得死死的。

除了商业大模型,学术界也在死磕底层技术。比如arXiv上最新提出的CMA-OT框架,专门搞“看舞生歌”的D2M生成。它解决了一个核心痛点:舞蹈动作线索稀疏,跟音乐对不上号。通过分层专家监督,生成的音乐节奏和风格能跟舞蹈视频严丝合缝。从文本生歌到视频生曲,AI音乐的想象力才刚刚开始。