Kimi K3发布后的热度尚未消退,DeepSeek V4正式版的测试视频和实机演示又开始在国内外AI社区流传。
根据目前的爆料,参与测试的用户将这一版本称为DeepSeek V4“正式版”或“满血版”,并声称其在软件开发、Agent任务、3D内容生成和复杂推理等场景中取得了明显提升。
部分测试者认为,DeepSeek V4正式版的综合表现已经接近Claude Opus 4.8;还有更激进的说法称,其在少数特定任务中超过了Fable 5和GPT-5.6。相关爆料还提到,新版本的思考和回答风格更加简洁,减少了冗长解释,交互体验更接近Claude。(finance.sina.com.cn)
不过,这些结果目前主要来自测试视频、社交媒体和科技媒体转述。测试者没有完整公开模型版本哈希、系统提示词、推理预算、测试次数和统一评分标准,因此尚不能作为正式基准成绩。
截至2026年7月20日,DeepSeek官网仍将当前模型标记为 DeepSeek V4 Preview,官方文档也没有公布正式版发布日期。DeepSeek还特别提醒用户,应以官方账号发布的消息为准,其他渠道的说法不代表DeepSeek立场。

“下周一发布”具体是哪一天?
相关报道发布于2026年7月19日,其中提到DeepSeek V4正式版“可能在下周一发布”。
按照这一时间计算,传闻指向的日期是:
2026年7月27日,星期一。
另有消息称,正式版可能在7月20日后数日内上线,但不同爆料之间并不完全一致。由于DeepSeek尚未发布倒计时、预告文章或正式公告,目前不能把7月27日视为已经确认的发布日期。
DeepSeek V4其实早已发布预览版
DeepSeek V4并不是一款从未公开的新模型。
2026年4月24日,DeepSeek已经正式发布并开放V4预览版,包括两个主要版本:
| 模型 | 总参数 | 激活参数 | 主要定位 |
|---|---|---|---|
| DeepSeek-V4-Pro | 1.6万亿 | 490亿 | 高性能推理、编程和Agent |
| DeepSeek-V4-Flash | 2840亿 | 130亿 | 更快、更低成本的日常与Agent任务 |
两个版本均采用混合专家架构,支持100万Token上下文、思考与非思考两种模式,以及JSON输出、工具调用、前缀续写等API能力。
DeepSeek同时开放了技术报告和模型权重,用户可通过网页版、App、API和Hugging Face使用或部署V4预览版。
因此,本轮社区所说的“DeepSeek V4正式版”,更可能指在预览版基础上完成后训练、交互优化和服务稳定性调整后的GA版本,而不是第一次发布DeepSeek V4。
V4正式版可能升级哪些能力?
目前没有正式技术报告可以确认新旧版本差异,但从测试者和媒体披露的信息看,升级方向主要集中在以下几个方面。
1. 编程和软件工程能力
测试者认为,新版本在代码理解、跨文件修改和复杂项目执行方面更加稳定。
这与DeepSeek V4预览版的官方定位一致。DeepSeek此前表示,V4-Pro重点加强Agentic Coding,在开源模型的编程Agent评测中达到较强水平,并已经用于DeepSeek团队内部的Agent编程工作。
正式版可能继续优化:
- 大型代码仓库理解
- 跨文件功能开发
- 终端工具调用
- 测试运行和错误修复
- 前端页面开发
- 长时间编程任务
- 多步骤Agent执行
- 代码修改后的自我验证
不过,“在特定任务中超过Fable 5和GPT-5.6”的说法,目前只来自非官方测试,仍需等待统一环境下的第三方复现。
2. Agent执行更加稳定
Agent任务不只是回答一个问题,而是需要模型持续制定计划、调用工具、读取结果、修正错误并完成交付。
DeepSeek V4预览版已经针对Agent能力进行专门优化,可接入Claude Code、OpenClaw和OpenCode等工具,并同时支持OpenAI ChatCompletions与Anthropic格式API。
正式版可能重点解决:
- 长任务中途停止
- 工具调用后遗忘目标
- 多轮执行出现重复操作
- 计划与实际执行不一致
- 面对错误时无法恢复
- 输出内容过长、重点不清晰
这些能力是否真正提升,需要通过SWE-bench、Terminal-Bench、浏览器任务和真实代码仓库进行验证。
3. 3D和视觉开发表现受到关注
部分测试者提到,V4正式版在3D网页、交互内容和视觉开发任务中的表现超出预期,甚至声称明显领先Opus 4.8。
不过,DeepSeek V4现有官方页面主要强调文本、推理、编程、长上下文和Agent能力,并未把原生视觉输入列为V4预览版的主要功能。
因此,测试视频中的“3D能力”更可能是指模型通过代码生成Three.js、WebGL或其他3D网页应用,而不一定代表正式版已经加入图片、视频等原生多模态输入。
正式发布后,需要重点确认:
- 是否原生支持图片输入
- 是否可以读取网页截图
- 是否支持视频理解
- 是否具备视觉反馈闭环
- 3D任务是纯代码生成还是多模态协作
在官方模型卡公布前,不宜直接将DeepSeek V4描述为原生视觉大模型。
回答风格可能变得更简洁
早期DeepSeek推理模型经常展示较长的分析过程。在复杂任务中,详细推理有助于模型检查步骤,但也会增加等待时间和阅读成本。
本轮测试者表示,V4正式版减少了重复说明,思考过程更聚焦,最终答案也更容易阅读,整体风格接近Claude。
这种变化可能来自以下调整:
- 后训练数据更新
- 回答长度偏好调整
- 思考与最终答案分离
- 更严格的指令遵循
- 减少重复总结
- 加强结论优先的表达方式
但“更像Claude”属于主观体验,不代表模型架构、训练方法或输出内容与Claude相同。
100万Token上下文已经是现有能力
无论正式版何时发布,100万Token上下文并不是本轮爆料才出现的新功能。
DeepSeek V4-Pro和V4-Flash预览版已经将100万Token设为官方服务的标准上下文长度,最高输出长度达到384K Token。
100万Token上下文适合处理:
- 大型软件代码库
- 多份研究报告
- 长篇合同和业务材料
- 大量网页搜索结果
- 多轮Agent执行记录
- 企业知识库
- 长篇小说与书籍
- 跨文件数据分析
DeepSeek V4使用Token级压缩与DeepSeek Sparse Attention,以降低超长上下文带来的计算和显存压力。
正式版是否进一步增加上下文长度、提高有效信息利用率或优化缓存效率,目前尚未确认。
DeepSeek V4价格有多低?
DeepSeek当前API已经提供V4-Pro和V4-Flash。
官方每100万Token价格如下:
| 模型 | 缓存命中输入 | 缓存未命中输入 | 输出 |
| DeepSeek-V4-Flash | 0.0028美元 | 0.14美元 | 0.28美元 |
| DeepSeek-V4-Pro | 0.003625美元 | 0.435美元 | 0.87美元 |
两个模型均支持100万Token上下文、工具调用、JSON输出以及思考和非思考模式。
从官方标价看,DeepSeek仍然把低调用成本作为重要竞争点。
不过,判断一个模型是否真正“便宜”,不能只看每百万Token价格,还要同时考虑:
- 完成任务需要多少输出Token
- 是否会因为失败而反复重试
- 缓存命中率
- Agent调用次数
- 推理速度
- 任务成功率
- 工具调用稳定性
- 是否需要人工修正
若一个价格较低的模型需要多次重试,实际项目成本未必更低。
DeepSeek V4与Kimi K3如何比较?
Kimi K3是月之暗面于2026年7月发布的旗舰模型,总参数达到2.8万亿,拥有100万Token上下文,并原生支持图片和视频理解。
Kimi K3重点面向长程编程、知识工作、科学研究与复杂Agent任务,完整模型权重计划于2026年7月27日前发布。
两款模型当前的已知差异如下:
| 对比方向 | DeepSeek V4-Pro预览版 | Kimi K3 |
| 总参数 | 1.6万亿 | 2.8万亿 |
| 激活参数 | 490亿 | 官方未按相同口径单独列出 |
| 上下文 | 100万Token | 100万Token |
| 视觉输入 | 官方暂未列为核心能力 | 原生支持图片与视频 |
| 思考模式 | 支持开启或关闭 | 始终开启,可调思考强度 |
| 主要方向 | 推理、编程、Agent | 长程编程、知识工作、多模态Agent |
| 当前状态 | 预览版权重已开放 | 服务已上线,完整权重拟于7月27日前发布 |
| API输出价格 | 0.87美元/百万Token | 100元/百万Token |
DeepSeek V4-Pro价格来自DeepSeek官方API页面;Kimi K3的官方API价格为缓存命中输入2元、未命中输入20元、输出100元,每100万Token计费。
由于两家采用不同币种、缓存策略、模型规模和产品能力,仅凭标价无法完整判断谁的性价比更高。
若DeepSeek V4正式版在保持现有价格量级的同时,将编程和Agent能力提升至接近顶级闭源模型,其低成本优势会更加明显。
但在原生视觉、视频理解和多模态知识工作方面,Kimi K3目前公开的信息更加完整。
为什么DeepSeek可能选择此时发布正式版?
Kimi K3刚刚发布,千问3.8预览版也已进入阿里云和Qoder,中国大模型市场在2026年7月进入密集更新阶段。
如果DeepSeek选择在这一时间推出V4正式版,可以迅速获得开发者、企业用户和全球开源社区的关注。
不过,DeepSeek自身的产品节奏也提供了一个值得观察的时间节点:
deepseek-chat和deepseek-reasoner两个旧API名称将在 2026年7月24日15:59 UTC 后停止访问。目前它们分别映射至V4-Flash的非思考和思考模式。
旧模型名称下线后,DeepSeek可能进一步统一V4产品与API入口。这个时间安排与“7月底发布正式版”的传闻接近,但二者之间并不存在官方确认的因果关系。
实测视频为什么不能直接视为正式评测?
AI模型的演示视频很容易受到测试条件影响。
同一个模型在以下条件下可能呈现完全不同的结果:
- 系统提示词不同
- 思考模式不同
- 推理Token预算不同
- 是否允许联网
- 是否调用代码执行工具
- 是否进行多次生成后挑选最佳结果
- 测试环境和依赖不同
- 是否对提示词进行针对性优化
- 是否使用内部未公开版本
如果测试者只展示成功案例,而没有公布失败结果,观众也很难判断模型的稳定性。
因此,正式版发布后,更值得关注的是:
- 官方技术报告
- 开放模型权重
- 模型卡和许可证
- 第三方基准评测
- 统一提示词下的横向测试
- 真实代码仓库任务
- 多次运行成功率
- API稳定性和延迟
DeepSeek V4正式版还需确认哪些信息?
最终参数是否变化
预览版V4-Pro为1.6万亿总参数、490亿激活参数。正式版是否沿用相同架构和规模,目前未知。
是否继续开放权重
V4预览版已经开放权重,正式版大概率会延续开放路线,但仍需等待官方公告确认具体版本和许可证。
是否支持原生视觉
社区演示中出现3D和视觉开发任务,但官方尚未确认正式版是否加入图像或视频输入。
正式版API价格
现有价格适用于V4-Pro和V4-Flash。正式版发布后是否调整峰谷价格、并发或缓存策略,需要以最新定价页面为准。
正式评测数据
有关超过Fable 5、GPT-5.6或接近Opus 4.8的说法,需要官方技术报告和第三方评测验证。
预览版用户如何升级
开发者需要关注API模型名称、上下文格式、思考历史、工具调用接口和旧模型迁移方案。
现在如何体验DeepSeek V4?
用户目前不必等待传闻中的正式版,即可体验DeepSeek V4预览版。
DeepSeek网页端
用户可以进入DeepSeek官网或网页版,在专家模式与即时模式中使用不同能力的V4模型。
DeepSeek App
最新版DeepSeek App已接入当前旗舰模型,适合普通对话、文件阅读、内容生成和代码任务。
DeepSeek API
开发者可以使用以下模型名称:
deepseek-v4-pro
deepseek-v4-flash
API同时兼容OpenAI ChatCompletions和Anthropic格式。
开放模型权重
V4-Pro和V4-Flash预览版的权重已在DeepSeek Hugging Face官方账号发布,可用于研究、部署和框架适配。
总结
DeepSeek V4正式版的测试视频和实机演示已经在社区流传。
爆料者认为,新版本在编程、Agent、3D内容生成和回答风格方面获得明显改善,综合性能可能接近Claude Opus 4.8,部分特定任务甚至被声称超过Fable 5与GPT-5.6。
不过,截至2026年7月20日,DeepSeek尚未确认正式版发布日期,也没有发布最终技术报告或完整评测。
社区所说的“下周一”指向2026年7月27日,但这一日期仍属于传闻。DeepSeek官网目前继续将V4标注为预览版本,并提醒外界以官方消息为准。
已经得到官方确认的是,V4预览版包含1.6万亿参数的V4-Pro和2840亿参数的V4-Flash,两者均拥有100万Token上下文,并已开放API、技术报告和模型权重。
DeepSeek V4正式版能否真正对Kimi K3和顶级闭源模型形成压力,关键不只在单项演示成绩,还要看正式评测、视觉能力、长任务稳定性、实际价格和开放权重后的社区适配。
在官方公告发布前,更准确的文章口径是:
DeepSeek V4正式版实测内容曝光,传闻或于2026年7月27日发布,但具体日期与性能数据仍待DeepSeek确认。










评论区 (0)
最新评论登录后发布评论并参与互动。
暂无评论,欢迎抢沙发。