腾讯这次把 3D 世界生成又往前推了一步。

腾讯混元团队正式发布并开源了 混元 3D 世界模型 2.0,也就是 HY-World 2.0。这次升级最核心的看点,不只是“能生成世界”,而是它已经开始从过去偏展示型的视频输出,走向 可交互、可编辑、可落地使用的 3D 空间资产生成

说白一点,以前很多世界模型更像是在“生成一个能看的结果”,而这次腾讯想做的,是直接生成 能继续编辑、能导入引擎、能真正进入制作流程的 3D 内容。这一步,含金量明显更高。

HY-World 2.0 到底是什么?

从官方介绍来看,HY-World 2.0 是一个 多模态世界模型,能够理解文本、图片、视频等不同输入,并进一步完成 3D 世界的生成、重建与模拟。

它和很多仅输出视频结果的世界模型不太一样。HY-World 2.0 的目标,不只是给你一段“看起来很像 3D 世界”的视频,而是进一步产出 可以长期存在、可以被编辑、可以被探索的 3D 世界内容

这意味着它的定位已经不只是演示效果,而是明显朝着更实用的 3D 生产工具在走。

这次升级最重要的突破是什么?

最大的变化可以概括成一句话:
从生成视频,迈向生成真正可编辑的 3D 资产。

这件事为什么重要?因为过去不少世界模型虽然能做出很惊艳的镜头感和空间感,但它们最后给到用户的,往往只是一个视频文件。你能看、能传播、能展示,但很难真正把它拿进游戏、美术、仿真或者空间制作流程里继续用。

而 HY-World 2.0 这次往前迈了一步。它不只是给你一个视觉结果,而是直接生成 可编辑 3D 资产。这意味着这些结果不再只是“好看”,而是开始具备“可继续生产”的价值。

HY-World 2.0 能生成什么?

从目前公开信息看,HY-World 2.0 支持输出多种常见的 3D 资产形式,包括:

  • Mesh
  • 3DGS
  • 点云

这类输出格式的意义很直接:它们不是只能在某个封闭页面里看看,而是能够更自然地进入后续工作流。对做游戏、虚拟场景、数字内容、仿真训练和空间设计的人来说,这种兼容性本身就非常关键。

因为真正有价值的 AI 生成,不只是“生成出来”,而是“生成后还能接着用”。

为什么说它更接近实用化阶段?

因为它开始考虑“生成之后怎么办”这个问题了。

很多 AI 模型最容易卡住的地方,不是前面的 demo 漂不漂亮,而是后面的接入成本高不高。HY-World 2.0 之所以更值得关注,就是因为它已经不只是停留在前端生成效果,而是明显在往完整制作流程靠拢。

比如支持多格式导出、支持引擎兼容、支持后续编辑,这些看起来像“工程细节”的东西,实际上才是模型能不能真正落地的关键。

对行业来说,这比单纯强调“世界一致性更强”“画面更震撼”更有现实意义。

它和之前的世界模型有什么不同?

过去主流世界模型更多是在做两件事:
一是生成视频,二是保证空间一致性。

但 HY-World 2.0 在这两件事之外,又补了一层很重要的能力:
把生成结果变成可持续使用的 3D 空间资产。

这就让它的定位发生了变化。它不再只是一个演示型模型,而更像是一个连接 生成、重建、探索、编辑、引擎接入 的 3D 世界生产底座。

如果说之前很多世界模型更偏“让你看到 AI 能生成世界”,
那 HY-World 2.0 更像是在回答另一个问题:
AI 生成的世界,能不能真正被拿来做事?

空间一致性为什么仍然重要?

虽然这次大家都在聊可编辑 3D 资产,但世界模型里另一个核心指标依然很关键,那就是 空间一致性

因为一个 3D 世界如果只有局部漂亮、整体却逻辑混乱,那最终还是很难使用。世界模型最怕的,就是场景一转、视角一换、结构就飘了,或者前后内容对不上。

HY-World 2.0 这次强调的一个重点,就是它在空间一致性和世界记忆上继续增强。简单理解,就是让模型生成的世界在不同视角、不同路径和不同探索方式下,依然尽可能保持稳定。

这类能力的重要性在于:
只有“空间是稳的”,后续的编辑、导出和引擎接入才有意义。否则再多格式支持,也只是把一个不稳定结果导出去而已。

为什么腾讯这步动作值得关注?

因为腾讯本身就在 3D、游戏和实时交互生态上有天然优势。

当一个大厂去做世界模型时,外界通常会看两个问题:
第一,它能不能把模型做出来;
第二,它有没有足够多的应用场景把模型真正用起来。

腾讯在这件事上的想象空间,显然不只停留在论文或 demo。无论是游戏引擎、数字内容生产,还是虚拟空间和交互场景,腾讯都有很强的接入土壤。所以 HY-World 2.0 的开源,不只是一次模型更新,也像是在给整个 3D AI 生态提前铺路。

这对创作者和开发者意味着什么?

对创作者来说,这意味着 3D 内容制作的门槛可能还会继续往下掉。

以前做 3D 世界,很多流程都高度依赖专业软件、手工建模、复杂的相机和资产处理流程。而现在,随着世界模型越来越成熟,未来的工作方式可能会逐渐变成:
先用文本、图片或视频快速生成基础世界,再在此基础上编辑、修正、扩展,最后导入实际项目。

对开发者来说,这种模型最大的价值在于 缩短从创意到可用资产之间的距离。它不会直接替代所有传统流程,但很可能会成为前期概念验证、场景草模、原型生成和内容扩展的高效入口。

这是否意味着 AI 3D 生成进入了新阶段?

可以这么看。

因为过去大家更多是在讨论“AI 能不能生成 3D”,
而现在开始转向“AI 生成的 3D,能不能直接进生产流程”。

这个变化很关键。前者更像技术展示,后者才是产业化问题。

HY-World 2.0 这次之所以值得聊,就是因为它正在往后者靠。它不只是想证明 AI 能把 3D 世界做出来,还想证明这些结果能够被真正接住、继续编辑、继续开发,并最终进入游戏、仿真、内容创作等实际场景。

总结

整体来看,腾讯混元 3D 世界模型 2.0 的开源,最值得关注的地方,不只是“世界模型又升级了”,而是它把 AI 世界生成从“视频级展示”继续推向了“资产级落地”。

从多模态输入,到可编辑 3D 输出;
从单纯生成结果,到支持导出和引擎接入;
从炫技 demo,到更接近真实工作流。

这意味着,AI 驱动的 3D 内容创作,正在从“看起来很强”逐步走向“真的能用”。

而对整个行业来说,这种变化可能比一次单纯的性能刷新,更值得长期关注。

官方与公开参考入口: https://3d-models.hunyuan.tencent.com/world/https://github.com/Tencent-Hunyuan/HY-World-2.0