腾讯 Hy4 要来了:更大参数、更强 RL,WorkBuddy 也准备换上新“大脑”
腾讯新一代大模型 Hy4,距离正式发布越来越近了。

近期曝光的腾讯内部测试界面中,Hy4 已经出现在模型列表,并被标注为:
“专家级大模型”。
相比目前的 Hy3,腾讯此前已经确认:
Hy4 参数规模会进一步扩大,同时继续强化 RL 后训练和多模态能力。
如果说 Hy3 主要解决大量日常和专业任务,那么 Hy4 的定位显然更偏向:
复杂推理、Coding、长程任务以及高难度 Agent 场景。
而它正式上线以后,一个非常值得关注的落地方向就是:
WorkBuddy。
一、Hy4 是什么?
Hy4 是腾讯混元下一代旗舰大模型。
目前可以确认的升级方向主要包括:
- 参数规模比 Hy3 更大;
- 强化学习规模继续扩大;
- 多模态能力继续增强;
- 面向更复杂的 Coding 和 Agent 任务;
- 与腾讯真实 AI 产品继续进行协同优化。
不过目前腾讯还没有正式公布:
Hy4 具体参数;
上下文长度;
API 价格;
Benchmark;
是否开放权重。
所以现阶段对于“万亿参数”等说法,仍然应该以正式发布信息为准。
二、内部测试界面出现“专家级大模型”
这次曝光的测试界面很有意思。
目前可以看到类似这样的模型分层:
Hy4:专家级大模型
Hy3:适合大量日常与专业任务
DeepSeek:偏复杂推理
如果最终正式产品继续采用这种模式,腾讯的思路会非常清楚:
不是所有任务都调用最大的模型。
而是根据:
任务复杂度;
响应速度;
推理需求;
成本
选择不同模型。
这也是 AI Agent 接下来非常重要的:
Model Router,模型路由。
三、Hy4 最大升级之一:更强的强化学习
相比单纯讨论 Hy4 到底有多少参数,我觉得更值得关注的是:
RL,也就是强化学习。
现在越来越多大模型开始发现:
当 Base Model 已经足够强以后,真正拉开 Coding、Agent 和复杂推理能力差距的,很可能是后训练。
腾讯也明确把:
更大规模强化学习
作为混元下一阶段的重要方向。
整个逻辑可以理解成:
更大 Base Model
+
更强 RL
+
真实 Agent 任务
+
产品反馈
=
Hy4这和最近整个大模型行业的发展方向非常接近。
四、Hy4 会和 WorkBuddy 结合得更深
WorkBuddy 是腾讯目前非常重要的 AI 办公 Agent。
它已经不只是一个聊天工具,而是可以继续处理:
文件;
Excel;
PPT;
网页;
浏览器;
Skills;
自动化任务;
复杂工作流。
因此 WorkBuddy 对模型的要求,和普通聊天助手完全不同。
例如:
调研 10 家竞争对手,整理数据生成 Excel,再制作一份 15 页 PPT。
背后可能连续调用:
网页搜索;
资料阅读;
数据分析;
代码;
文件编辑;
PPT 生成。
这种长任务非常适合检验 Hy4 的真实 Agent 能力。
所以 Hy4 发布以后,我觉得最值得看的不是:
聊天是不是聪明了一点。
而是:
WorkBuddy 能不能把以前容易中断、跑偏或者做不完的复杂任务稳定做完。
五、WorkBuddy 并不会只剩一个模型
这里也需要说清楚。
目前还不能直接写:
Hy4 将成为 WorkBuddy 唯一核心模型。
WorkBuddy 本身采用的是:
多模型 + Harness
路线。
除了腾讯混元,还可以根据场景使用其他模型。
所以更准确的说法是:
Hy4 很可能成为 WorkBuddy 下一阶段最重要的腾讯自研核心模型之一。
真正决定 WorkBuddy 好不好用的,也不只是模型。
还包括外层:
Tools;
Skills;
浏览器;
电脑操作;
Sandbox;
Memory;
Model Router;
Agent Workflow。
也就是现在越来越多人讨论的:
Harness。
六、模型越强,Harness 反而越重要
可以把 Agent 简单理解成:
Agent = Model + Harness
Hy4 负责:
思考。
WorkBuddy 负责:
让模型真正干活。
比如模型知道应该:
修改 Excel;
搜索网页;
生成 PPT。
但真正执行这些操作,还需要 WorkBuddy 提供:
文件系统;
浏览器;
工具调用;
Skills;
任务调度;
运行环境。
所以 Hy4 的价值,需要和 WorkBuddy 的 Harness 能力结合起来看。
更强模型 + 更成熟 Harness,才更可能让复杂 Agent 任务真正稳定下来。
七、多模态能力也会继续提升
腾讯目前已经确认:
Hy4 会进一步增强多模态能力。
这一点对 WorkBuddy 尤其重要。
因为真实办公场景不是纯文本。
用户面对的是:
PDF;
PPT;
Excel;
截图;
图片;
网页;
图表。
比如用户直接说:
把 PPT 第 3 页的数据换成 Excel 里的最新结果,保持原来的设计样式。
Agent 必须同时理解:
页面视觉;
数据;
图表;
文件;
设计结构。
所以未来办公 Agent 的竞争,也会越来越依赖:
模型能不能真正看懂用户正在操作的数字世界。
八、腾讯正在走“模型 + Agent + 产品”路线
现在回头看腾讯这一轮 AI 布局,会发现路径已经非常清楚。
模型
Hy3 → Hy4
Agent
WorkBuddy、CodeBuddy 等
产品
元宝、ima 以及腾讯内部大量业务场景
基础设施
腾讯云、GPU、Sandbox、Agent Runtime
它并不是只想:
发布一个 Benchmark 很强的大模型。
而是想把模型真正塞进:
办公;
Coding;
内容;
企业服务;
腾讯自己的产品生态
里面长期使用。
真实用户产生的任务,又可以继续反馈到下一轮模型训练。
这也是腾讯一直强调的:
Model-Product Co-Design。
九、目前关于 Hy4,哪些已经确定?
目前可以比较确认的是:
Hy4 已经存在并正在训练。
参数规模会比 Hy3 更大。
强化学习会继续扩大。
多模态能力会继续增强。
将在 2026 年稍晚发布。
近期曝光的内部测试界面,也说明 Hy4 已经越来越接近实际产品测试阶段。
但以下信息暂时还不能写死:
参数是否达到 1T;
具体 Benchmark;
上下文长度;
API 价格;
是否开放权重;
正式发布日期。
这些都需要等待腾讯官宣。
结语
腾讯 Hy4 现在最值得关注的,不只是:
“又一个新大模型要来了。”
更重要的是它背后的产品路线。
Hy4 会拥有:
更大的模型规模;
更强 RL;
更强多模态;
更复杂 Agent 能力。
而 WorkBuddy 则提供:
工具;
Skills;
文件;
浏览器;
Sandbox;
模型路由;
工作流。
两者组合起来,才是真正的:
AI Agent。
所以 Hy4 正式发布以后,我最想看的其实不是第一张 Benchmark 排行榜。
而是:
换上 Hy4 以后,WorkBuddy 到底能不能把复杂任务做得更快、更稳、更完整。
如果答案是可以,
那 Hy4 才算真正发挥出了它作为“专家级大模型”的价值。
相关链接
腾讯官方网站
腾讯混元官网
腾讯混元 / 腾讯云大模型
https://cloud.tencent.com/product/hunyuan
WorkBuddy 官网
https://workbuddy.tencent.com/
腾讯云 WorkBuddy
https://cloud.tencent.cn/act/pro/workbuddy
WorkBuddy 官方文档
https://cloud.tencent.com/document/product/1831
腾讯投资者关系 / 财报
https://www.tencent.com/zh-cn/investors/financial-news.html
腾讯 AI 官方动态
https://www.tencent.com/zh-cn/articles.html
标签






评论 0
最新评论登录后发布评论并参与互动。
暂无评论,欢迎抢沙发。