推荐Lovart 中文版 - 一站式 AI 设计平台推荐一人企业Vibe Coding社区!热门AI设计工具新品免费AI编程工具 Trae - 智能编码助手Seedance2.5已上线新用户注册即领免费算力
UIED.CN今天偷学哪一招,朋友

昆仑万维发布 Mureka V9.5:深化 MusiCoT 音乐思维链,让 AI 音乐减少“机械堆砌”

image.png


2026 年 8 月 18 日,昆仑万维正式发布新一代 AI 音乐生成模型 Mureka V9.5。目前模型已面向国内和海外用户开放,Mureka 国际官网首页也已经出现“新模型 V9.5”入口及大量 V9.5 用户作品。(k.sina.com.cn) (mureka.ai)

这次更新的重点并不是让编曲更复杂,而是强调:

克制、留白、自然。

目标是减少 AI 音乐常见的“机械堆砌感”。(aibase.com)

官方还公布了一组内部评测数据:

  • 人声表现良品率:61.0%
  • Prompt 控制良品率:97.0%
  • 风格完整体现率:95.7%

同时,V9.5 重点改善中文咬字、换气、情绪表达、和声与旋律关系,以及国风民族乐器表现。(ainativefoundation.org)

需要说明的是,61.0%、97.0% 和 95.7% 都属于昆仑万维公布的内部评测指标,并不是独立第三方排行榜成绩。




一、Mureka V9.5 是什么?

Mureka 是昆仑万维旗下 AI 音乐创作平台。

目前已经覆盖:

  • AI 歌曲生成;
  • 纯音乐生成;
  • 歌词生成;
  • 音乐延长;
  • Remix;
  • 音轨分离;
  • 音乐识别与描述;
  • 图片 / 视频配乐;
  • 音乐 API。

Mureka 官方 API 平台介绍显示,其消费级音乐产品于 2024 年上线,目前全球用户规模已经接近 1000 万,同时面向企业和开发者提供音乐生成 API、模型微调与音乐内容服务。(platform.mureka.ai)




二、MusiCoT 并不是 V9.5 才第一次出现

很多介绍会写成:

Mureka V9.5 引入 MusiCoT。

更准确的说法是:

V9.5 继续深化 MusiCoT。

MusiCoT 全称:

Music Chain-of-Thought

即:

音乐思维链。

Mureka 此前的音乐推理模型以及 V8、V9 系列已经持续围绕这条技术路线迭代;官方此前对 O1 的介绍中,也已经将音乐推理、多语言歌曲和场景 BGM 等能力作为核心方向。(platform.mureka.ai)

V9.5 更进一步强调:

先规划音乐,再生成音频。

可以简单理解成:

理解 Prompt
↓
判断曲风和情绪
↓
规划整首歌曲结构
↓
确定段落关系
↓
安排动态与情绪变化
↓
规划人声与编曲
↓
再开始生成音频

按照此次发布信息,模型会从宏观歌曲结构一路规划到更细节的音乐表达,再进行实际生成。(aibase.com)




三、为什么 V9.5 开始强调“少一点”?

现在 AI 音乐的问题已经不只是结构不完整、旋律重复或者人声机械。

另一个很典型的问题是:

AI 太爱堆东西。

鼓、Bass、Pad、弦乐、和声、Synth、FX、Backing Vocal 全部往里面加。

第一遍副歌已经很满,第二遍副歌只能继续加,最后整首音乐哪里都很满,反而没有真正的重点。

Mureka V9.5 这次反过来强调:

Less is more。

让编曲为旋律、人声和情绪留下空间。(aibase.com)

比如一段悲伤主歌,如果只留下钢琴、人声和少量空间效果,进入副歌后再加入鼓、Bass 和和声,情绪变化才真正成立。

所以音乐并不是元素越多越高级。

很多时候真正成熟的编曲,恰恰知道:

什么时候不应该加东西。




四、人声良品率 61.0%,重点改善气息和情绪

AI 音乐最容易暴露“AI 味”的通常是人声。

例如:

一句话没有真正换气;

连续唱很长的歌词;

尾音突然被切断;

整首歌保持同一种力度;

情绪没有真实变化。

根据昆仑万维此次公布的内部评测,Mureka V9.5:

人声表现良品率达到 61.0%。

官方重点强调:

气息和情绪表达更加接近真人演唱。 (ainativefoundation.org)

人声自然度也不只是音色像不像真人,还包括:

呼吸;

咬字;

重音;

强弱;

情绪;

不同歌词之间的连接。

所以真正需要解决的是:

Performance。

不只是:

Voice。




五、Prompt 控制良品率 97.0%

Mureka V9.5 另外两项官方内部指标是:

Prompt 控制良品率 97.0%。

以及:

风格完整体现率 95.7%。 (ainativefoundation.org)

这一点对于真正的音乐创作非常重要。

普通用户可以抽卡十次,总能碰到一首不错的。

但专业创作更需要:

我要 A,你尽量给我 A。

比如用户指定:

  • 男声 / 女声;
  • 国风;
  • R&B;
  • 90 BPM;
  • 情绪逐渐增强;
  • 第二次副歌才加入和声;
  • Bridge 去掉鼓;
  • 结尾回到钢琴。

模型到底能不能准确执行,决定了它能否真正进入稳定创作工作流。




六、中文与国风是 V9.5 的重点方向

中文歌曲对 AI 来说并不简单。

它涉及:

声调;

咬字;

停顿;

断句;

换气;

词义。

一句中文歌词如果在错误的位置换气,即使每个字都唱对了,听起来依然很别扭。

Mureka V9.5 此次重点提升了中文长句的咬字准确度,同时优化气口与情绪起伏。(aibase.com)

国风也是同样的问题。

真正的国风并不是:

古筝
+
二胡
+
笛子
+
大鼓
=
中国风

昆仑万维此次表示,V9.5 进一步优化了:

和声与旋律平衡,以及民族乐器本身的表现

希望减少简单堆叠“中国风符号”的做法。(aibase.com)

这对于华语流行、民谣、古风、国风、中文 Rap 和民族音乐等本土场景都很有意义。




七、Mureka 目前处在全球 AI 音乐第一梯队

目前 Artificial Analysis 最新公开榜单主要测试的是 Mureka V9,暂时还没有看到 V9.5 的独立排名。

在 Instrumental Music 排行榜中,Mureka V9 位于第一梯队,Elo 约 1192,与 Suno V5.5 非常接近。(artificialanalysis.ai)

在 Vocals Music 榜单中,Suno V5.5 当前排名第一,Mureka V9 第二,两者 Elo 约为:

1171 vs 1157。 (artificialanalysis.ai)

因此更准确的说法是:

Mureka V9 系列此前已经处于全球 AI 音乐模型第一梯队,而 V9.5 刚刚正式开放,还需要等待更多独立评测。




八、从 V8、V9 到 V9.5,方向越来越清楚

V8

重点解决:

音乐整体完成度。

让 AI 音乐从“能生成”继续向“生成的作品真的可以听”推进。

V9

继续强化:

可控性。

目前 Artificial Analysis 上,Mureka V9 仍处在人声和纯音乐两个榜单头部。(artificialanalysis.ai)

V9.5

这一代进一步处理:

自然感。

也就是:

少一点;

慢一点;

空一点;

像人一点。




九、V9.5 的调整参考了 25,000+ 用户反馈

根据此次发布资料,Mureka V9.5 的迭代结合了全球 超过 25,000 名用户的反馈。(ainativefoundation.org)

用户需求主要集中在:

  • 长段落音乐更加一致;
  • 人声更加真实;
  • 减少明显机器生成感。

因此 V9.5 把重点放在:

Consistency、Vocals、Naturalness。

这也符合生成式 AI 产品逐渐成熟后的变化:

早期大家看能力,后期开始抠体验。




十、Mureka 已经不只是“AI 写歌网站”

Mureka 官方 API 更新记录显示,平台目前已经陆续增加:

  • Song Generation;
  • Instrumental Generation;
  • Lyrics Generation;
  • Song Extension;
  • Remix;
  • Lyrics Video;
  • Image / Video Soundtrack;
  • Music Transcription;
  • Track Generation;
  • Song Describe。

(platform.mureka.ai)

开发者还可以通过官方 API:

https://api.mureka.ai

接入自己的应用。

官方 Quickstart 使用 Bearer API Key 认证,并支持直接创建歌曲生成任务。(platform.mureka.ai)

Mureka 官方目前还提供三类 B2B 能力:

标准音乐生成 API

模型微调

以及:

音乐内容服务。 (platform.mureka.ai)

其中模型微调可以针对特定音乐数据训练专属模型,用于更稳定地生产特定风格音乐。




十一、图片和视频也可以成为音乐输入

Mureka 移动端目前明确支持:

通过文字、图片或视频生成原创歌曲。

并继续控制歌词、风格和人声。(play.google.com)

整个流程以后可以变成:

上传视频
↓
AI 理解画面
↓
判断节奏和情绪
↓
生成匹配音乐

Mureka API 也已经提供:

Soundtrack Generation

接口,可以基于用户提供的输入生成配乐。(platform.mureka.ai)

这对于短视频、游戏、广告、电影概念片和 Vlog 都比较实用。




十二、普通用户可以怎么玩 Mureka V9.5?

可以直接尝试:

一句话生成中文歌曲

做一首关于一个人在凌晨坐最后一班地铁回家的中文城市民谣。男声,声音克制,前半段只使用钢琴和吉他,第二次副歌加入轻鼓和弦乐,最后重新回到安静。

做国风音乐

创作一首东方古风歌曲,女声,整体克制空灵。不要堆叠大量民族乐器,以古琴为主要伴奏,洞箫只在间奏出现,副歌加入少量弦乐,重点保证中文咬字和自然气口。

生成短视频 BGM

为一段 60 秒东方神话巨构视频生成电影感纯音乐,前 15 秒安静、空旷,中段逐渐增加低频和打击乐,45 秒进入高潮,不要人声,最后快速收束。

还可以用于:

游戏音乐;

广告;

品牌 Demo;

自己写歌词再交给 AI 作曲。




十三、专业音乐人更适合把它当“灵感催化器”

AI 音乐不一定非要:

按一下按钮,把整首歌完全交给 AI。

对专业音乐人来说,更实用的方式可能是:

快速试听一个方向。

例如:

如果一首古风歌曲加入 Trip-Hop 节奏会怎么样?

过去要开 DAW、找音色、写和弦、做鼓、录 Demo。

现在可以先生成几个版本,再判断这个创意是否值得继续制作。

AI 不一定负责最终作品。

但可以帮助:

把模糊想法快速变成可以听见的 Demo。




十四、Mureka V9.5 和 Suno 怎么选?

目前不适合简单说谁全面更强。

两款产品都在快速迭代。

从当前 Artificial Analysis 榜单看:

Suno V5.5 在 Vocals 排名略高;

Mureka V9 在 Instrumental 与 Suno V5.5 处在非常接近的第一梯队。(artificialanalysis.ai)

Mureka V9.5 当前更值得关注的是:

  • 中文歌曲;
  • 国风;
  • MusiCoT;
  • Prompt 可控性;
  • 人声自然感;
  • API 和专业创作链路。

更实际的方式依然是:

同一个 Prompt,两边都生成,再看谁更符合自己的目标。




十五、商用前仍然要看版权和授权

如果生成音乐准备投入:

广告;

游戏;

影视;

品牌项目;

音乐平台发行;

商业短视频。

需要进一步确认:

账号套餐;

商业授权;

生成内容权利;

参考音乐版权;

克隆人声授权。

Mureka 目前拥有独立服务协议和 API 服务协议,所以正式商业使用时,建议以最新官方条款为准,不要默认:

AI 生成音乐一定可以无限制商用。 (mureka.ai)




结语

Mureka V9.5 这次没有继续强调:

“元素更多、音乐更满、效果更炸。”

而是把重点放到了:

克制、留白和自然。

核心仍然建立在 MusiCoT(Music Chain-of-Thought)音乐思维链 上,让模型在生成以前先考虑歌曲结构、情绪推进、人声、旋律与编曲之间的关系。(aibase.com)

按照官方内部评测:

人声表现良品率 61.0%。

Prompt 控制良品率 97.0%。

风格完整体现率 95.7%。 (ainativefoundation.org)

同时,这一代还重点优化中文咬字、气口、情绪、国风和民族乐器编配。

AI 音乐接下来真正值得看的,已经不只是:

AI 会不会写歌?

而是:

AI 是否开始理解,音乐什么时候应该多一点,什么时候应该少一点。

标签

评论 0

最新评论

登录后发布评论并参与互动。

暂无评论,欢迎抢沙发。

推荐阅读

查看更多