昆仑万维发布 Mureka V9.5:深化 MusiCoT 音乐思维链,让 AI 音乐减少“机械堆砌”

2026 年 8 月 18 日,昆仑万维正式发布新一代 AI 音乐生成模型 Mureka V9.5。目前模型已面向国内和海外用户开放,Mureka 国际官网首页也已经出现“新模型 V9.5”入口及大量 V9.5 用户作品。(k.sina.com.cn) (mureka.ai)
这次更新的重点并不是让编曲更复杂,而是强调:
克制、留白、自然。
目标是减少 AI 音乐常见的“机械堆砌感”。(aibase.com)
官方还公布了一组内部评测数据:
- 人声表现良品率:61.0%
- Prompt 控制良品率:97.0%
- 风格完整体现率:95.7%
同时,V9.5 重点改善中文咬字、换气、情绪表达、和声与旋律关系,以及国风民族乐器表现。(ainativefoundation.org)
需要说明的是,61.0%、97.0% 和 95.7% 都属于昆仑万维公布的内部评测指标,并不是独立第三方排行榜成绩。
一、Mureka V9.5 是什么?
Mureka 是昆仑万维旗下 AI 音乐创作平台。
目前已经覆盖:
- AI 歌曲生成;
- 纯音乐生成;
- 歌词生成;
- 音乐延长;
- Remix;
- 音轨分离;
- 音乐识别与描述;
- 图片 / 视频配乐;
- 音乐 API。
Mureka 官方 API 平台介绍显示,其消费级音乐产品于 2024 年上线,目前全球用户规模已经接近 1000 万,同时面向企业和开发者提供音乐生成 API、模型微调与音乐内容服务。(platform.mureka.ai)
二、MusiCoT 并不是 V9.5 才第一次出现
很多介绍会写成:
Mureka V9.5 引入 MusiCoT。
更准确的说法是:
V9.5 继续深化 MusiCoT。
MusiCoT 全称:
Music Chain-of-Thought
即:
音乐思维链。
Mureka 此前的音乐推理模型以及 V8、V9 系列已经持续围绕这条技术路线迭代;官方此前对 O1 的介绍中,也已经将音乐推理、多语言歌曲和场景 BGM 等能力作为核心方向。(platform.mureka.ai)
V9.5 更进一步强调:
先规划音乐,再生成音频。
可以简单理解成:
理解 Prompt
↓
判断曲风和情绪
↓
规划整首歌曲结构
↓
确定段落关系
↓
安排动态与情绪变化
↓
规划人声与编曲
↓
再开始生成音频按照此次发布信息,模型会从宏观歌曲结构一路规划到更细节的音乐表达,再进行实际生成。(aibase.com)
三、为什么 V9.5 开始强调“少一点”?
现在 AI 音乐的问题已经不只是结构不完整、旋律重复或者人声机械。
另一个很典型的问题是:
AI 太爱堆东西。
鼓、Bass、Pad、弦乐、和声、Synth、FX、Backing Vocal 全部往里面加。
第一遍副歌已经很满,第二遍副歌只能继续加,最后整首音乐哪里都很满,反而没有真正的重点。
Mureka V9.5 这次反过来强调:
Less is more。
让编曲为旋律、人声和情绪留下空间。(aibase.com)
比如一段悲伤主歌,如果只留下钢琴、人声和少量空间效果,进入副歌后再加入鼓、Bass 和和声,情绪变化才真正成立。
所以音乐并不是元素越多越高级。
很多时候真正成熟的编曲,恰恰知道:
什么时候不应该加东西。
四、人声良品率 61.0%,重点改善气息和情绪
AI 音乐最容易暴露“AI 味”的通常是人声。
例如:
一句话没有真正换气;
连续唱很长的歌词;
尾音突然被切断;
整首歌保持同一种力度;
情绪没有真实变化。
根据昆仑万维此次公布的内部评测,Mureka V9.5:
人声表现良品率达到 61.0%。
官方重点强调:
气息和情绪表达更加接近真人演唱。 (ainativefoundation.org)
人声自然度也不只是音色像不像真人,还包括:
呼吸;
咬字;
重音;
强弱;
情绪;
不同歌词之间的连接。
所以真正需要解决的是:
Performance。
不只是:
Voice。
五、Prompt 控制良品率 97.0%
Mureka V9.5 另外两项官方内部指标是:
Prompt 控制良品率 97.0%。
以及:
风格完整体现率 95.7%。 (ainativefoundation.org)
这一点对于真正的音乐创作非常重要。
普通用户可以抽卡十次,总能碰到一首不错的。
但专业创作更需要:
我要 A,你尽量给我 A。
比如用户指定:
- 男声 / 女声;
- 国风;
- R&B;
- 90 BPM;
- 情绪逐渐增强;
- 第二次副歌才加入和声;
- Bridge 去掉鼓;
- 结尾回到钢琴。
模型到底能不能准确执行,决定了它能否真正进入稳定创作工作流。
六、中文与国风是 V9.5 的重点方向
中文歌曲对 AI 来说并不简单。
它涉及:
声调;
咬字;
停顿;
断句;
换气;
词义。
一句中文歌词如果在错误的位置换气,即使每个字都唱对了,听起来依然很别扭。
Mureka V9.5 此次重点提升了中文长句的咬字准确度,同时优化气口与情绪起伏。(aibase.com)
国风也是同样的问题。
真正的国风并不是:
古筝
+
二胡
+
笛子
+
大鼓
=
中国风昆仑万维此次表示,V9.5 进一步优化了:
和声与旋律平衡,以及民族乐器本身的表现
希望减少简单堆叠“中国风符号”的做法。(aibase.com)
这对于华语流行、民谣、古风、国风、中文 Rap 和民族音乐等本土场景都很有意义。
七、Mureka 目前处在全球 AI 音乐第一梯队
目前 Artificial Analysis 最新公开榜单主要测试的是 Mureka V9,暂时还没有看到 V9.5 的独立排名。
在 Instrumental Music 排行榜中,Mureka V9 位于第一梯队,Elo 约 1192,与 Suno V5.5 非常接近。(artificialanalysis.ai)
在 Vocals Music 榜单中,Suno V5.5 当前排名第一,Mureka V9 第二,两者 Elo 约为:
1171 vs 1157。 (artificialanalysis.ai)
因此更准确的说法是:
Mureka V9 系列此前已经处于全球 AI 音乐模型第一梯队,而 V9.5 刚刚正式开放,还需要等待更多独立评测。
八、从 V8、V9 到 V9.5,方向越来越清楚
V8
重点解决:
音乐整体完成度。
让 AI 音乐从“能生成”继续向“生成的作品真的可以听”推进。
V9
继续强化:
可控性。
目前 Artificial Analysis 上,Mureka V9 仍处在人声和纯音乐两个榜单头部。(artificialanalysis.ai)
V9.5
这一代进一步处理:
自然感。
也就是:
少一点;
慢一点;
空一点;
像人一点。
九、V9.5 的调整参考了 25,000+ 用户反馈
根据此次发布资料,Mureka V9.5 的迭代结合了全球 超过 25,000 名用户的反馈。(ainativefoundation.org)
用户需求主要集中在:
- 长段落音乐更加一致;
- 人声更加真实;
- 减少明显机器生成感。
因此 V9.5 把重点放在:
Consistency、Vocals、Naturalness。
这也符合生成式 AI 产品逐渐成熟后的变化:
早期大家看能力,后期开始抠体验。
十、Mureka 已经不只是“AI 写歌网站”
Mureka 官方 API 更新记录显示,平台目前已经陆续增加:
- Song Generation;
- Instrumental Generation;
- Lyrics Generation;
- Song Extension;
- Remix;
- Lyrics Video;
- Image / Video Soundtrack;
- Music Transcription;
- Track Generation;
- Song Describe。
开发者还可以通过官方 API:
接入自己的应用。
官方 Quickstart 使用 Bearer API Key 认证,并支持直接创建歌曲生成任务。(platform.mureka.ai)
Mureka 官方目前还提供三类 B2B 能力:
标准音乐生成 API
模型微调
以及:
音乐内容服务。 (platform.mureka.ai)
其中模型微调可以针对特定音乐数据训练专属模型,用于更稳定地生产特定风格音乐。
十一、图片和视频也可以成为音乐输入
Mureka 移动端目前明确支持:
通过文字、图片或视频生成原创歌曲。
并继续控制歌词、风格和人声。(play.google.com)
整个流程以后可以变成:
上传视频
↓
AI 理解画面
↓
判断节奏和情绪
↓
生成匹配音乐Mureka API 也已经提供:
Soundtrack Generation
接口,可以基于用户提供的输入生成配乐。(platform.mureka.ai)
这对于短视频、游戏、广告、电影概念片和 Vlog 都比较实用。
十二、普通用户可以怎么玩 Mureka V9.5?
可以直接尝试:
一句话生成中文歌曲
做一首关于一个人在凌晨坐最后一班地铁回家的中文城市民谣。男声,声音克制,前半段只使用钢琴和吉他,第二次副歌加入轻鼓和弦乐,最后重新回到安静。
做国风音乐
创作一首东方古风歌曲,女声,整体克制空灵。不要堆叠大量民族乐器,以古琴为主要伴奏,洞箫只在间奏出现,副歌加入少量弦乐,重点保证中文咬字和自然气口。
生成短视频 BGM
为一段 60 秒东方神话巨构视频生成电影感纯音乐,前 15 秒安静、空旷,中段逐渐增加低频和打击乐,45 秒进入高潮,不要人声,最后快速收束。
还可以用于:
游戏音乐;
广告;
品牌 Demo;
自己写歌词再交给 AI 作曲。
十三、专业音乐人更适合把它当“灵感催化器”
AI 音乐不一定非要:
按一下按钮,把整首歌完全交给 AI。
对专业音乐人来说,更实用的方式可能是:
快速试听一个方向。
例如:
如果一首古风歌曲加入 Trip-Hop 节奏会怎么样?
过去要开 DAW、找音色、写和弦、做鼓、录 Demo。
现在可以先生成几个版本,再判断这个创意是否值得继续制作。
AI 不一定负责最终作品。
但可以帮助:
把模糊想法快速变成可以听见的 Demo。
十四、Mureka V9.5 和 Suno 怎么选?
目前不适合简单说谁全面更强。
两款产品都在快速迭代。
从当前 Artificial Analysis 榜单看:
Suno V5.5 在 Vocals 排名略高;
Mureka V9 在 Instrumental 与 Suno V5.5 处在非常接近的第一梯队。(artificialanalysis.ai)
Mureka V9.5 当前更值得关注的是:
- 中文歌曲;
- 国风;
- MusiCoT;
- Prompt 可控性;
- 人声自然感;
- API 和专业创作链路。
更实际的方式依然是:
同一个 Prompt,两边都生成,再看谁更符合自己的目标。
十五、商用前仍然要看版权和授权
如果生成音乐准备投入:
广告;
游戏;
影视;
品牌项目;
音乐平台发行;
商业短视频。
需要进一步确认:
账号套餐;
商业授权;
生成内容权利;
参考音乐版权;
克隆人声授权。
Mureka 目前拥有独立服务协议和 API 服务协议,所以正式商业使用时,建议以最新官方条款为准,不要默认:
AI 生成音乐一定可以无限制商用。 (mureka.ai)
结语
Mureka V9.5 这次没有继续强调:
“元素更多、音乐更满、效果更炸。”
而是把重点放到了:
克制、留白和自然。
核心仍然建立在 MusiCoT(Music Chain-of-Thought)音乐思维链 上,让模型在生成以前先考虑歌曲结构、情绪推进、人声、旋律与编曲之间的关系。(aibase.com)
按照官方内部评测:
人声表现良品率 61.0%。
Prompt 控制良品率 97.0%。
风格完整体现率 95.7%。 (ainativefoundation.org)
同时,这一代还重点优化中文咬字、气口、情绪、国风和民族乐器编配。
AI 音乐接下来真正值得看的,已经不只是:
AI 会不会写歌?
而是:
AI 是否开始理解,音乐什么时候应该多一点,什么时候应该少一点。
标签






评论 0
最新评论登录后发布评论并参与互动。
暂无评论,欢迎抢沙发。