阿里新一代旗舰大模型 **千问3.8(Qwen3.8)**即将正式发布并开放权重。
2026年7月19日,参数规模达到 2.4T,即2.4万亿参数的Qwen3.8-Max-Preview率先上线。用户目前可以通过阿里云Token Plan、Qoder及QoderWork等产品体验预览版,提前测试模型在代码工程、专业办公、数据分析和复杂长程任务中的表现。
公开信息显示,Qwen3.8正式版将在近期推出并开放权重。不过,截至2026年7月20日,阿里尚未完整披露正式版发布日期、激活参数、上下文窗口、训练数据、开源许可证及本地部署要求。

Qwen3.8-Max-Preview是什么?
Qwen3.8-Max-Preview是阿里通义千问系列的新一代旗舰基座模型预览版。
阿里云与Qoder官方资料显示,该模型总参数达到2.4T,相较上一代旗舰模型Qwen3.7-Max,重点提升以下能力:
- 代码工程与软件开发
- 专业办公与知识工作
- 全栈项目开发
- 数据分析
- Office文档工作流
- 复杂长程任务
- 深度推理
- 视觉理解
- Agent工具调用
Qoder将其定位为面向软件工程、办公工作和深度推理的最新千问基座模型。阿里云模型列表则确认,Qwen3.8-Max-Preview同时支持推理、视觉理解和文本生成。
需要注意的是,Qwen3.8-Max-Preview目前仍属于预览模型。预览期间,阿里会持续调整和升级模型能力;预览结束后,该模型可能下线,或被正式版本替换。
2.4T参数意味着什么?
2.4T代表Qwen3.8-Max拥有约2.4万亿总参数。
这是千问系列迄今公布的最大参数规模之一,也意味着阿里正在将旗舰模型继续扩展至万亿参数以上。
不过,总参数数量不能直接等同于实际推理成本,也不能单独决定模型最终能力。
如果Qwen3.8采用混合专家架构,模型在处理每个Token时可能只激活部分专家参数,而不是调用全部2.4万亿参数。但截至目前,阿里尚未正式公布Qwen3.8的专家数量、单次激活参数及具体架构。
因此,当前可以确认的是模型总参数为2.4T,但以下信息仍需等待技术报告或模型卡:
- 模型采用稠密架构还是MoE架构
- 每次推理实际激活多少参数
- 专家数量及路由方式
- 上下文窗口上限
- 训练Token规模
- 视觉编码器结构
- 推理所需硬件
- 量化与低精度部署方案
参数规模可以反映模型容量,但实际使用体验还会受到训练数据、后训练、推理资源、Agent框架和工具环境影响。
Qwen3.8预览版已上线哪些平台?
目前公开确认支持Qwen3.8-Max-Preview的入口主要包括阿里云Token Plan、Qoder及QoderWork。
1. 阿里云Token Plan
阿里云Token Plan是一种面向个人和团队的模型订阅服务。
与传统API按实际Token数量结算不同,Token Plan使用Credits额度,让用户在支持的模型和Agent工具中消耗统一用量。
Qwen3.8-Max-Preview目前仅面向Token Plan订阅用户提供,尚未像Qwen3.7-Max一样出现在阿里云百炼的普通按量API模型列表中。
个人版目前包括Lite、Standard和Pro三个套餐,限时价格分别为39元、139元和499元每月;团队版则按照座席和共享额度收费。价格及活动可能调整,应以阿里云最新页面为准。
Token Plan还提供联网搜索、网页抓取、代码解释器、文搜图及图搜图等工具,可用于构建较完整的Agent工作流。
2. Qoder
Qoder是面向软件开发场景的Agentic Coding平台,提供桌面端、JetBrains插件、CLI、云端Agent和移动端等产品形态。
开发者可以在Qoder的模型选择器中切换至Qwen3.8-Max-Preview,用于:
- 阅读大型代码仓库
- 跨文件修改代码
- 编写新功能
- 修复复杂Bug
- 执行终端命令
- 运行测试
- 重构项目
- 分析工程结构
- 处理长时间开发任务
Qoder官方活动页面显示,Qwen3.8-Max-Preview已经覆盖Qoder Desktop、JetBrains插件、CLI、QoderWake、Cloud Agents以及移动端和网页端。
3. QoderWork
QoderWork是Qoder面向日常办公和知识工作的桌面AI助手。
与主要处理代码的Qoder不同,QoderWork可以读取和编辑本地文档、表格、演示文稿及PDF,也支持数据处理、浏览器自动化、桌面操作和定时任务。
用户只需描述希望获得的结果,QoderWork便可自主规划步骤、调用工具并生成可交付文件。
Qwen3.8-Max-Preview进入QoderWork,意味着其能力不仅会用于编程,也会接受真实办公场景的检验,例如:
- 分析多个Excel文件
- 制作行业研究报告
- 生成PPT演示文稿
- 整理本地文件
- 阅读和归纳PDF
- 操作网页并提取数据
- 执行多步骤办公任务
- 结合多个Agent完成复杂交付
Qwen3.8为什么先发布预览版?
阿里没有等到正式版和开放权重准备完毕后再一次性上线,而是先将Qwen3.8-Max-Preview接入商业产品。
这种发布方式可以同时实现三个目标。
提前收集真实任务反馈
公开基准测试通常只能覆盖模型能力的一部分。
模型进入Qoder和QoderWork后,会面对大型代码仓库、真实办公文件、复杂网页、不同操作系统和长时间任务。这些场景更容易暴露模型在稳定性、工具调用和指令遵循方面的问题。
预览期积累的结果可以用于调整正式版。
测试长程Agent能力
Agent任务与普通对话不同。
模型不仅要回答问题,还需要持续执行:
- 理解目标
- 制定计划
- 读取文件
- 调用工具
- 检查结果
- 处理错误
- 修改方案
- 完成交付
任何一个环节出现上下文丢失、工具调用错误或任务提前终止,都可能影响最终结果。
让预览版先进入Qoder和QoderWork,相当于在正式开放权重前进行更大范围的Agent压力测试。
为正式版开放权重做生态适配
超大参数模型开放后,需要推理框架、云平台和开发工具完成适配。
预览版先行可以让阿里提前测试:
- API兼容性
- 思考历史传递
- 工具调用格式
- 上下文缓存
- 并发限制
- 推理成本
- 不同Agent框架中的表现
- 模型安全和权限边界
待正式版开放权重后,相关工具和部署平台可以更快接入。
Qwen3.8目前只支持思考模式
阿里云文档显示,Qwen3.8-Max-Preview当前始终开启思考模式,暂不支持关闭。
模型支持通过reasoning_effort控制推理深度,目前提供:
xhighhighlow
默认档位为xhigh。
这说明Qwen3.8-Max-Preview更偏向复杂推理、代码工程和长程任务,而不是追求最低延迟的简单问答。
对于以下任务,更高思考强度可能带来帮助:
- 大型项目架构分析
- 跨文件代码重构
- 数学和逻辑推理
- 多步骤数据分析
- 长篇研究报告
- Agent任务规划
- 复杂Office工作流
但更长的思考过程通常也意味着更高的延迟和计算消耗。
正式版本是否会增加非思考模式或更灵活的混合推理机制,目前尚未公布。
Qwen3.8重点提升代码工程能力
Qwen3.8-Max-Preview首先进入Qoder系列产品,说明代码工程是这一代模型的重要方向。
代码工程能力并不只是根据提示生成一个函数,而是要求模型理解完整项目,并在多个工具之间持续工作。
典型任务包括:
- 分析数十万行代码
- 理解模块依赖关系
- 修改多个相关文件
- 运行测试并读取错误日志
- 修复编译和运行问题
- 迁移框架或依赖版本
- 调整数据库结构
- 完成前后端联调
- 检查安全和兼容性
- 输出完整变更说明
Qoder官方资料称,Qwen3.8-Max-Preview在全栈开发和复杂长程任务上相较Qwen3.7-Max有所提升。该结论目前主要来自阿里和Qoder自身评测,仍需等待正式技术报告及第三方测试进一步验证。
专业办公与Cowork成为新重点
除了Coding,阿里还反复强调Qwen3.8在Cowork和Office办公工作流中的能力。
所谓Cowork,可以理解为AI与用户围绕真实工作文件和业务任务持续协作。
例如,用户可以要求模型:
- 读取多个财务表格并制作分析报告
- 将一批PDF整理为研究材料
- 根据数据生成图表和PPT
- 从网页搜集资料并核对来源
- 制作合同或方案初稿
- 根据修改意见更新多个文件
- 自动整理会议资料和行动项
- 在浏览器中执行连续操作
这类任务需要模型同时具备文件理解、代码执行、浏览器操作、工具调用和成果交付能力。
Qwen3.8接入QoderWork,正是为了将模型放入这些实际工作流中进行测试。
为什么真实用户场景比单一榜单更重要?
模型发布时通常会展示数学、代码、推理和知识问答等基准成绩。
这些数据有助于进行统一比较,但不一定能完整反映模型在真实工作中的表现。
真实用户更加关注:
- 长任务会不会中途停止
- 是否能够正确操作本地文件
- 会不会修改任务范围外的内容
- 工具调用失败后能否自行恢复
- 多轮执行后是否遗忘最初要求
- 输出文档能否直接使用
- 代码是否能够通过测试
- 是否会产生错误数据
- 推理速度和成本是否可接受
预览版先进入Qoder、QoderWork和Token Plan,可以通过大量真实任务发现这些问题。
从产品策略看,阿里是在模型正式开放权重前,将开发者和知识工作者变成更大范围的测试者。这一判断属于基于当前发布路径作出的分析。
预览期推出低折扣活动
Qwen3.8-Max-Preview上线期间,阿里云和Qoder同步推出限时折扣。
Qoder官方页面显示:
| 使用时段 | Credits倍率 | 相对标准倍率 |
|---|---|---|
| 常规时段08:00—22:00 | 0.05x | 1折 |
| 错峰时段22:00—次日08:00 | 0.01x | 0.2折 |
| 原标准倍率 | 0.5x | 标准价格 |
活动时间从2026年7月19日开始,结束时间暂未公布。折扣只影响Credits消耗,不会改变模型质量和上下文长度。
阿里云Token Plan个人版也提供相同的预览期优惠:常规调用Credits低至1折,夜间在此基础上再享2折。
大幅降低预览期使用成本,可以吸引用户运行更多长时间和高消耗任务,为正式版积累更丰富的反馈数据。
Qwen3.8正式版将开放权重
据千问官方消息及多家媒体报道,Qwen3.8正式版将在近期发布并开放权重。
这意味着开发者未来可能获得模型权重,用于研究、部署、微调或构建行业应用。
不过,“开放权重”和“完全开源”并不一定是同一个概念。
正式发布后,还需要关注以下信息:
- 是否开放基础模型权重
- 是否开放指令模型权重
- 使用什么许可证
- 是否允许商业使用
- 是否允许模型蒸馏
- 是否限制特定行业用途
- 是否公开训练代码
- 是否提供推理代码
- 是否提供量化版本
- 是否支持消费级硬件
- 是否同步登陆Hugging Face和魔搭社区
在许可证和完整仓库发布前,文章中使用“即将开放权重”会比“已经完整开源”更加准确。
千问家族持续推进开放模型路线
阿里此前已经开放多款Qwen3系列模型,包括稠密模型和混合专家模型。
Qwen3首批模型覆盖0.6B至235B等多个规模,基础模型和指令模型采用Apache 2.0许可证公开,支持开发者下载、部署和二次开发。
千问还围绕不同场景发布了多个开放模型系列:
- Qwen3基础语言模型
- Qwen3-Coder代码模型
- Qwen3-VL视觉语言模型
- Qwen3-Embedding向量模型
- Qwen-Image图像生成模型
- Qwen-Audio语音模型
- Qwen-Omni全模态模型
Qwen3.8正式版开放后,将进一步补充千问家族的超大参数旗舰模型。
不过,2.4T参数也会带来较高的显存、存储和集群通信需求。即使权重开放,普通个人电脑预计也很难完整部署。
Qwen3.8与Qwen3.7有什么区别?
目前官方没有发布完整对比表,但根据已公开信息,可以作出以下阶段性比较:
| 对比项目 | Qwen3.7-Max | Qwen3.8-Max-Preview |
| 产品状态 | 正式商用模型 | 预览模型 |
| 模型定位 | 上一代旗舰Max | 新一代旗舰Max |
| 总参数 | 官方当前页面未在同一口径披露 | 2.4T |
| 思考模式 | 支持思考与非思考模式 | 始终开启思考 |
| 推理深度 | 依接口配置 | xhigh、high、low |
| 视觉理解 | 部分快照支持 | 支持 |
| 代码工程 | 强 | 官方称进一步提升 |
| Cowork办公 | 支持 | 重点增强 |
| 普通百炼API | 已开放 | 当前仅Token Plan可用 |
| 开放权重 | 未作为同名Max权重开放 | 正式版拟近期开源 |
以上比较依据阿里云现有产品文档整理,Qwen3.8最终规格仍可能在正式版中调整。
Qwen3.8正式发布后值得关注什么?
1. 激活参数规模
如果模型采用MoE架构,激活参数将直接影响推理成本和硬件需求。
2. 上下文窗口
长程代码和专业办公需要较大的上下文,但官方目前尚未公布Qwen3.8的具体上限。
3. 多模态范围
阿里云已经确认预览版支持视觉理解,但是否支持视频、音频或更复杂的跨模态输出,仍需等待说明。
4. Agent基准
Qwen3.8重点面向代码工程与Cowork任务,因此SWE-bench、Terminal-Bench、浏览器任务和办公Agent评测更具参考价值。
5. 推理成本
2.4T总参数模型的实际部署价格,将影响开发者是否能够大规模使用。
6. 开放许可证
许可证会决定企业能否商用、微调、蒸馏和重新发布模型。
7. 第三方框架适配
需要观察vLLM、SGLang、llama.cpp、Ollama和Transformers等社区工具是否能够快速支持。
Qwen3.8适合哪些用户提前体验?
软件开发者
适合测试大型项目理解、跨文件重构、Bug修复和终端工具调用。
数据分析人员
可以用于读取表格、编写分析代码、生成图表和整理报告。
产品与运营团队
适合制作方案、研究竞品、整理用户反馈及生成演示文稿。
投研与咨询人员
可尝试处理公司公告、行业报告、财务文件和多来源研究任务。
企业办公团队
可以通过Token Plan团队版或QoderWork测试文档、表格和浏览器自动化流程。
Agent开发者
适合检验模型在规划、工具调用、错误恢复和长任务执行方面的表现。
使用预览版需要注意什么?
能力可能持续变化
预览期间模型会不断调整,同一个任务在不同日期的结果可能存在差异。
不适合未经审核直接进入生产环境
涉及正式代码、财务数据、合同和重要业务决策时,仍需人工检查。
记录模型版本和测试日期
进行团队评测时,应保存使用时间、提示词、推理强度和运行环境,避免不同版本结果难以比较。
注意套餐和Credits限制
低折扣不等于无限使用。用户仍需查看套餐额度、并发限制及子Agent产生的额外调用。
等待正式许可证
计划私有化部署或商业二次开发的团队,应等待正式权重和许可证发布后再作决定。
总结
阿里新一代旗舰模型千问3.8即将正式发布并开放权重。
率先上线的Qwen3.8-Max-Preview总参数达到2.4T,目前已经进入阿里云Token Plan、Qoder和QoderWork,重点面向代码工程、专业办公、数据分析、视觉理解和复杂长程任务。
预览版当前始终开启思考模式,并支持xhigh、high和low三档推理深度。阿里通过低折扣方式鼓励开发者和知识工作者运行更多真实任务,从而在正式发布前检验模型稳定性、工具调用和成果交付能力。
正式版将在近期推出并开放权重,但具体发布日期、激活参数、上下文窗口、完整评测和许可证仍待公布。
从发布路径看,阿里正在把模型评测从实验室榜单扩展到代码工程和真实办公流程。Qwen3.8最终能否在开放后形成更广泛的开发者生态,还要看其实际性能、部署成本、许可证和社区工具适配情况。










评论区 (0)
最新评论登录后发布评论并参与互动。
暂无评论,欢迎抢沙发。