AI音乐生成这周彻底炸了。Suno和ElevenLabs前后脚发布新模型,学术界还在研究怎么给舞蹈视频自动配乐,三条线同时推进,赛道热度拉满。
Suno CEO Mikey Shulman甩出v6模型套件,这次拉来华纳音乐、BMG、Believe一起打磨。旗舰版v6主打稳定输出,跨流派都能出精修成品,面向Pro和Premier用户;另含v6-wild等模型,构成完整创作矩阵。用自然语言就能改歌、混音、采样,门槛又降一截。
ElevenLabs也没闲着,发布ElevenMusic v2.5,同步开放移动应用和API。新版音频饱满度和自然感都有提升,47,885对样本盲测中多数听众投了v2.5。R&B、灵魂乐、嘻哈、摇滚、管弦乐,这些曲风表现更突出。
学术圈同样没停。arXiv上新论文CMA-OT瞄准Dance-to-Music生成,核心难点是舞蹈动作信号稀疏,跟音乐语义对不上。团队用分层专家监督机制来弥合这个gap,让生成的音乐在节奏和风格上跟舞蹈视频对齐。
从Suno的厂牌合作、ElevenLabs的API开放,到学术界的舞蹈配乐研究,AI音乐正在从"能听"走向"能用"。商业化、工具化、学术突破三股力量同时发力。2025年这个赛道值得盯紧。