千问办公曾上线 GLM-5.3 与 DeepSeek V4 Pro:国产旗舰模型一度完成三家聚合
国内办公 Agent 的模型竞争,开始变得越来越有意思了。

8 月 14 日晚间,阿里巴巴旗下 AI Agent 产品 千问办公(QwenWork) 宣布上线两款最新国产旗舰模型:
智谱 GLM-5.3
以及:
DeepSeek V4 Pro。
用户当时可以直接在千问办公首页的“前沿模型”档位选择使用。加上此前已经上线的 Qwen3.8-Max,千问办公一度同时覆盖阿里千问、智谱和 DeepSeek 三家国产大模型厂商的旗舰产品。
对于一款办公 Agent 来说,这个变化值得关注。
因为它意味着产品竞争开始从:
“我背后用的是哪一个模型?”
逐渐走向:
“面对不同办公任务,我到底可以调动多少模型和工具?”
不过事情在 8 月 17 日晚又出现了新变化。
目前千问办公官方帮助中心的模型选择页面,只显示:
高级、基础、经济、Qwen3.8-Max
四个选项,GLM-5.3 与 DeepSeek V4 Pro 已经不在当前可用模型列表中。媒体同日晚间也观察到两款外部模型从产品端消失,而此前发布相关消息的公众号文章已经转为作者隐私设置。阿里方面目前尚未公开说明具体原因。
所以如果现在再讨论这件事,更准确的说法应该是:
千问办公曾在 8 月 14 日完成 Qwen、智谱、DeepSeek 三家旗舰模型的短暂聚合,但截至 8 月 17 日晚,GLM-5.3 与 DeepSeek V4 Pro 已暂时从产品端撤下。
一、千问办公是什么?
千问办公是阿里巴巴推出的一站式 AI 办公 Agent 产品。
它和普通 AI 聊天助手比较明显的区别,在于产品强调:
不只是回答问题,而是直接完成任务和交付结果。
根据千问办公官方介绍,它目前可以覆盖数据分析、PPT 生成、视频剪辑、网页搭建、文件处理、市场研究等场景,并通过个人云盘、IM、Skills、连接器、电脑操控以及浏览器自动化等能力进入实际办公工作流。
例如你可以直接说:
分析这份 Excel,找出最近一个季度销售额下滑最明显的三个区域,生成图表,并制作一份汇报 PPT。
传统聊天模型可能先告诉你:
“可以按照以下步骤操作。”
而办公 Agent 更希望做到:
读取文件 → 分析数据 → 生成图表 → 整理观点 → 生成 PPT → 交付文件。
这也是现在 AI 办公产品越来越强调 Agent 的原因。
二、千问办公 8 月 3 日才刚刚开启公测
千问办公实际上是一款非常新的产品。
2026 年 8 月 3 日,千问办公正式开启公测。
新华社报道称,新的千问办公由 QoderWork、MuleRun、悟空 三款产品整合而来,并定位为同时覆盖桌面端 Agent、云端 Agent 和企业协同 Agent 的产品。个人和企业用户都可以通过官网体验。
也就是说,从公开测试到接入 GLM-5.3 和 DeepSeek V4 Pro,中间实际上只有十多天。
产品更新节奏非常快。
目前千问办公已经提供 Web 网页端以及客户端。官方客户端下载页面显示,现阶段支持:
macOS 14+、Windows 10+ 和 HarmonyOS 6.1+。
网页端则可以直接通过浏览器进入。
三、Qwen3.8-Max:千问自己的旗舰模型
在 GLM-5.3 和 DeepSeek V4 Pro 之前,千问办公已经率先接入:
Qwen3.8-Max。
这是阿里目前最新一代旗舰千问模型之一。
Qwen 官方介绍显示,Qwen3.8-Max 规模达到 2.4T 参数,主要面向 Coding、办公、研究以及 Long-Horizon 长程任务。
千问 AI 平台的模型更新记录则显示,qwen3.8-max 于 2026 年 8 月 3 日正式加入平台,采用 MoE 架构,并支持 1M 上下文。
这其实和千问办公的定位非常契合。
因为办公 Agent 和普通聊天不同。
一个复杂任务可能需要连续完成:
读取文件、搜索资料、调用工具、生成代码、修改内容、检查结果、制作文件。
上下文越长、长程执行能力越强,越适合这种连续 Agent 工作流。
四、GLM-5.3:智谱最新旗舰模型
GLM-5.3 是智谱在 8 月发布的新旗舰模型。
智谱官方将 GLM-5.3 的重点能力放在:
复杂软件工程、Terminal 操作,以及更加广泛的真实 Agent 任务。
同时针对 Coding 能力进一步进行了后训练扩展。
其中一个很有意思的地方是:
GLM-5.3 并不是单纯为了聊天而设计。
它明显更加关注:
Coding Agent;
复杂工程;
多步骤工具调用;
长程任务。
这也是为什么它会出现在办公 Agent 的模型选择中。
因为今天的办公已经不仅仅是:
写邮件;
改文案;
总结会议纪要。
一个真正复杂的企业 Agent 可能还需要:
操作网页;
处理数据库;
写脚本;
生成 Excel;
修改代码;
调用 API;
自动完成一整套工作流。
模型的 Agent 能力越强,覆盖的任务范围就越大。
五、DeepSeek V4 Pro:百万上下文 + 384K 最大输出
另外一个重量级模型就是:
DeepSeek V4 Pro。
当前正式 API 对应版本为:
DeepSeek-V4-Pro-0813
DeepSeek 官方文档显示,V4 Pro 支持:
1M 上下文长度
以及最高:
384K Token 输出。
同时支持 Tool Calls、JSON Output、Responses API 和 Anthropic API,并支持思考模式与非思考模式。
这套规格非常适合:
大型代码仓库;
长文档;
复杂研究;
长时间运行的 Agent。
尤其对于办公 Agent 来说,一项任务可能不是一轮对话,而是几十步连续执行。
这时候模型需要持续记住:
用户目标是什么;
已经处理了哪些文件;
工具返回了什么;
下一步应该做什么;
最终需要交付什么。
长上下文和 Agent 能力的重要性自然会更加明显。
六、为什么办公 Agent 开始做多模型聚合?
其实答案很简单:
没有任何一个模型在所有任务上都一定是最优解。
有的模型:
Coding 更强。
有的:
研究能力更好。
有的:
响应速度快。
有的:
Token 便宜。
有的:
长上下文更稳定。
所以如果一个办公 Agent 同时面对:
简单翻译;
Excel 整理;
复杂研究;
代码生成;
PPT;
数据分析;
网页制作;
长程自动化任务。
所有任务都固定使用同一个最贵的旗舰模型,并不一定合理。
这也是多模型 Agent 很重要的一层逻辑。
理想状态下:
简单任务 → 快模型;
复杂任务 → 强模型;
Coding → Coding 强项模型;
大量批处理 → 更低成本模型。
然后再由 Agent 在后台负责调度。
千问办公此前接入 GLM-5.3 与 DeepSeek V4 Pro 时,目前主要仍然由用户自己选择模型;媒体当时也提到,更进一步的方向会是由 Agent 根据任务难度、模型能力和调用成本进行自动路由。
七、未来真正重要的可能是 Model Router
当一个 AI 产品里只有一个模型时:
不需要选择。
但如果里面有:
Qwen;
GLM;
DeepSeek;
以及不同性能档位。
新的问题马上就来了:
到底什么时候应该调用谁?
这时候就需要:
Model Router,模型路由。
例如用户说:
把这 100 个文件统一重命名。
这种任务不一定需要旗舰模型。
但如果说:
阅读公司过去三年的财报、行业报告和内部数据,分析业务下滑原因,并给管理层制定一份完整战略方案。
显然更适合强模型。
未来一个成熟办公 Agent,最好不是要求普通用户先研究:
哪个 Benchmark 高;
谁 Coding 强;
谁 Token 便宜。
而是:
用户只说自己要做什么。
剩下的由 Agent 自动判断。
这可能才是多模型聚合最终真正有价值的地方。
八、不过千问办公这次“三模型聚合”只维持了几天
这也是现在写这篇文章最需要注意的地方。
8 月 14 日:
千问办公宣布 GLM-5.3、DeepSeek V4 Pro 上线。
加上 Qwen3.8-Max,三家国产旗舰模型一度同时进入千问办公。
8 月 17 日晚:
GLM-5.3 与 DeepSeek V4 Pro 从产品端消失。
当前千问办公官方帮助中心重新只列出:
高级;
基础;
经济;
Qwen3.8-Max。
媒体报道显示,两款外部模型上线仅约三天就被撤下,而阿里方面目前还没有公布具体原因。
因此现在还无法确认:
这是临时产品调整;
模型服务调整;
测试结束;
还是千问办公多模型策略本身发生变化。
目前都不适合直接下结论。
九、官方其实已经明确:模型列表会动态更新
千问办公官方帮助中心有一句话,现在回头看非常关键:
QwenWork 的模型列表会持续更新。
官方表示,会不断引入新的优秀模型,并根据:
模型表现;
市场情况
替换或下线旧模型,以保持模型列表质量。
也就是说,从产品机制来看:
模型并不是永久固定的。
以后完全有可能出现:
今天新增一个模型;
下个月替换;
某个模型升级;
某个模型退出。
对于用户来说,也就没必要太执着于:
“千问办公到底固定绑定哪几个模型。”
真正应该关注的可能是:
它能不能持续把当时最合适的模型放进办公工作流。
十、千问办公不只是模型选择器
如果千问办公最后只是:
把 Qwen、GLM、DeepSeek 放在一个下拉菜单里。
其实价值有限。
真正值得关注的是它正在构建的其他 Agent 能力。
根据官方帮助中心,目前千问办公已经拥有:
Skills;
专家套件;
连接器;
电脑操控;
浏览器自动化;
个人网盘;
定时任务;
Hooks;
IM 频道;
设计工作台;
幻灯片工作台;
写作工作台。
例如定时任务可以让 QwenWork 在云端按照设定时间自动执行工作,即使浏览器关闭也可以继续运行;连接器则用于把 Agent 与邮件、日历、钉钉等外部系统连接起来。
这才更接近完整的:
AI Agent 工作台。
模型只是里面负责思考的一层。
外面还有大量真正负责:
执行、存储、连接和交付
的能力。
十一、千问办公正在明显向企业级 Agent 靠拢
千问办公官方目前的定位已经不仅仅是个人 AI 助手。
产品提供个人版和企业版,并强调打通钉钉、企业后台、SSO、成员管理和积分管理等企业能力。
新华社在千问办公开启公测时也提到,其重点之一就是企业市场,未来希望进一步连接企业数据库和工作流。
这与普通 Chatbot 的逻辑很不一样。
企业真正关心的不只是:
“AI 会不会写文章?”
还会关心:
能不能访问企业数据;
权限怎么管理;
能不能连接业务系统;
任务能不能自动执行;
数据是否隔离;
复杂流程能不能稳定跑完。
所以最终决定办公 Agent 上限的,不只是哪一个模型 Benchmark 更高。
还包括整个:
Agent 系统能力。
十二、独立 App 和国际版进展怎么看?
此前新浪科技在报道千问办公接入 GLM-5.3 与 DeepSeek V4 Pro 时提到,千问办公后续还计划推出独立 App 以及国际版。
不过截至 2026 年 8 月 17 日,官方客户端下载页面目前已经提供:
macOS;
Windows;
HarmonyOS
三个平台,其中 HarmonyOS 可以通过 AppGallery 获取。
目前官方页面尚未显示 iOS、Android 国际版或单独的国际官网入口,因此“国际版”仍应以官方后续发布为准。
十三、这件事真正值得关注的是什么?
如果只看新闻标题:
千问办公上线两个新模型。
好像只是:
模型列表又多了两个选项。
但往深一点看,它反映的是办公 Agent 正在出现一种新的产品逻辑。
以前是:
一个 AI 产品 = 一个主模型。
以后可能越来越接近:
一个 Agent = 多模型 + Skills + Tools + Connectors + Storage + Automation。
模型只是其中的一层。
最终用户可能根本不关心:
现在后台到底跑的是 Qwen、GLM 还是 DeepSeek。
他真正关心的是:
我让你做的事情,到底能不能做好?
如果一个 Agent 能够根据任务自动完成:
模型路由;
工具选择;
上下文管理;
文件读写;
网页操作;
工作流执行;
最终交付。
那么“用了哪个模型”对普通用户来说,反而会逐渐退到后台。
结语
千问办公这几天的模型变化,其实非常有代表性。
8 月 3 日:
千问办公开启公测,并上线 Qwen3.8-Max。
8 月 14 日:
GLM-5.3 与 DeepSeek V4 Pro 加入,一度形成:
Qwen + GLM + DeepSeek
三家国产旗舰模型同时出现在一个办公 Agent 中的局面。
8 月 17 日晚:
两款外部旗舰模型又从产品端消失,目前官方模型选择页面重新只显示高级、基础、经济和 Qwen3.8-Max。
短短几天,产品策略就出现了明显变化。
这也说明现在办公 Agent 的竞争远没有定型。
模型还在快速升级。
产品还在不断试验。
多模型怎么路由;
企业数据怎么连接;
Agent 如何稳定完成长程任务;
Skills 和 Connectors 怎么扩展;
这些问题都还在快速寻找答案。
所以相比单纯讨论:
“谁家模型最强?”
接下来可能更值得看的反而是:
“谁最会把这些模型用起来?”
相关链接
- 千问办公官网
https://qwenwork.cn/ - 千问办公网页版
https://qwenwork.cn/app - 千问办公帮助中心
https://qwenwork.cn/docs - 千问办公当前模型选择说明
https://qwenwork.cn/docs/features/model-selection - 千问办公客户端下载:macOS / Windows / HarmonyOS
https://qwenwork.cn/download - 千问 AI 平台
https://www.qianwenai.com/ - Qwen3.8-Max 官方介绍
https://qwen.ai/blog?id=qwen3.8 - 千问 AI 平台模型更新记录
https://platform.qianwenai.com/docs/changelog/models - GLM-5.3 官方发布文章
https://z.ai/blog/glm-5.3 - GLM-5.3 官方开发文档
https://docs.z.ai/guides/llm/glm-5.3 - DeepSeek V4 Pro 正式版官方公告
https://api-docs.deepseek.com/zh-cn/news/news260813 - DeepSeek V4 Pro 模型与 API 价格文档
https://api-docs.deepseek.com/zh-cn/quick_start/pricing
标签






评论 0
最新评论登录后发布评论并参与互动。
暂无评论,欢迎抢沙发。