Kimi K3发布后的热度尚未消退,DeepSeek V4正式版的测试视频和实机演示又开始在国内外AI社区流传。

根据目前的爆料,参与测试的用户将这一版本称为DeepSeek V4“正式版”或“满血版”,并声称其在软件开发、Agent任务、3D内容生成和复杂推理等场景中取得了明显提升。

部分测试者认为,DeepSeek V4正式版的综合表现已经接近Claude Opus 4.8;还有更激进的说法称,其在少数特定任务中超过了Fable 5和GPT-5.6。相关爆料还提到,新版本的思考和回答风格更加简洁,减少了冗长解释,交互体验更接近Claude。(finance.sina.com.cn)

不过,这些结果目前主要来自测试视频、社交媒体和科技媒体转述。测试者没有完整公开模型版本哈希、系统提示词、推理预算、测试次数和统一评分标准,因此尚不能作为正式基准成绩。

截至2026年7月20日,DeepSeek官网仍将当前模型标记为 DeepSeek V4 Preview,官方文档也没有公布正式版发布日期。DeepSeek还特别提醒用户,应以官方账号发布的消息为准,其他渠道的说法不代表DeepSeek立场。

image.png

“下周一发布”具体是哪一天?

相关报道发布于2026年7月19日,其中提到DeepSeek V4正式版“可能在下周一发布”。

按照这一时间计算,传闻指向的日期是:

2026年7月27日,星期一。

另有消息称,正式版可能在7月20日后数日内上线,但不同爆料之间并不完全一致。由于DeepSeek尚未发布倒计时、预告文章或正式公告,目前不能把7月27日视为已经确认的发布日期。

DeepSeek V4其实早已发布预览版

DeepSeek V4并不是一款从未公开的新模型。

2026年4月24日,DeepSeek已经正式发布并开放V4预览版,包括两个主要版本:

模型总参数激活参数主要定位
DeepSeek-V4-Pro1.6万亿490亿高性能推理、编程和Agent
DeepSeek-V4-Flash2840亿130亿更快、更低成本的日常与Agent任务

两个版本均采用混合专家架构,支持100万Token上下文、思考与非思考两种模式,以及JSON输出、工具调用、前缀续写等API能力。

DeepSeek同时开放了技术报告和模型权重,用户可通过网页版、App、API和Hugging Face使用或部署V4预览版。

因此,本轮社区所说的“DeepSeek V4正式版”,更可能指在预览版基础上完成后训练、交互优化和服务稳定性调整后的GA版本,而不是第一次发布DeepSeek V4。

V4正式版可能升级哪些能力?

目前没有正式技术报告可以确认新旧版本差异,但从测试者和媒体披露的信息看,升级方向主要集中在以下几个方面。

1. 编程和软件工程能力

测试者认为,新版本在代码理解、跨文件修改和复杂项目执行方面更加稳定。

这与DeepSeek V4预览版的官方定位一致。DeepSeek此前表示,V4-Pro重点加强Agentic Coding,在开源模型的编程Agent评测中达到较强水平,并已经用于DeepSeek团队内部的Agent编程工作。

正式版可能继续优化:

  • 大型代码仓库理解
  • 跨文件功能开发
  • 终端工具调用
  • 测试运行和错误修复
  • 前端页面开发
  • 长时间编程任务
  • 多步骤Agent执行
  • 代码修改后的自我验证

不过,“在特定任务中超过Fable 5和GPT-5.6”的说法,目前只来自非官方测试,仍需等待统一环境下的第三方复现。

2. Agent执行更加稳定

Agent任务不只是回答一个问题,而是需要模型持续制定计划、调用工具、读取结果、修正错误并完成交付。

DeepSeek V4预览版已经针对Agent能力进行专门优化,可接入Claude Code、OpenClaw和OpenCode等工具,并同时支持OpenAI ChatCompletions与Anthropic格式API。

正式版可能重点解决:

  • 长任务中途停止
  • 工具调用后遗忘目标
  • 多轮执行出现重复操作
  • 计划与实际执行不一致
  • 面对错误时无法恢复
  • 输出内容过长、重点不清晰

这些能力是否真正提升,需要通过SWE-bench、Terminal-Bench、浏览器任务和真实代码仓库进行验证。

3. 3D和视觉开发表现受到关注

部分测试者提到,V4正式版在3D网页、交互内容和视觉开发任务中的表现超出预期,甚至声称明显领先Opus 4.8。

不过,DeepSeek V4现有官方页面主要强调文本、推理、编程、长上下文和Agent能力,并未把原生视觉输入列为V4预览版的主要功能。

因此,测试视频中的“3D能力”更可能是指模型通过代码生成Three.js、WebGL或其他3D网页应用,而不一定代表正式版已经加入图片、视频等原生多模态输入。

正式发布后,需要重点确认:

  • 是否原生支持图片输入
  • 是否可以读取网页截图
  • 是否支持视频理解
  • 是否具备视觉反馈闭环
  • 3D任务是纯代码生成还是多模态协作

在官方模型卡公布前,不宜直接将DeepSeek V4描述为原生视觉大模型。

回答风格可能变得更简洁

早期DeepSeek推理模型经常展示较长的分析过程。在复杂任务中,详细推理有助于模型检查步骤,但也会增加等待时间和阅读成本。

本轮测试者表示,V4正式版减少了重复说明,思考过程更聚焦,最终答案也更容易阅读,整体风格接近Claude。

这种变化可能来自以下调整:

  • 后训练数据更新
  • 回答长度偏好调整
  • 思考与最终答案分离
  • 更严格的指令遵循
  • 减少重复总结
  • 加强结论优先的表达方式

但“更像Claude”属于主观体验,不代表模型架构、训练方法或输出内容与Claude相同。

100万Token上下文已经是现有能力

无论正式版何时发布,100万Token上下文并不是本轮爆料才出现的新功能。

DeepSeek V4-Pro和V4-Flash预览版已经将100万Token设为官方服务的标准上下文长度,最高输出长度达到384K Token。

100万Token上下文适合处理:

  • 大型软件代码库
  • 多份研究报告
  • 长篇合同和业务材料
  • 大量网页搜索结果
  • 多轮Agent执行记录
  • 企业知识库
  • 长篇小说与书籍
  • 跨文件数据分析

DeepSeek V4使用Token级压缩与DeepSeek Sparse Attention,以降低超长上下文带来的计算和显存压力。

正式版是否进一步增加上下文长度、提高有效信息利用率或优化缓存效率,目前尚未确认。

DeepSeek V4价格有多低?

DeepSeek当前API已经提供V4-Pro和V4-Flash。

官方每100万Token价格如下:

模型缓存命中输入缓存未命中输入输出
DeepSeek-V4-Flash0.0028美元0.14美元0.28美元
DeepSeek-V4-Pro0.003625美元0.435美元0.87美元

两个模型均支持100万Token上下文、工具调用、JSON输出以及思考和非思考模式。

从官方标价看,DeepSeek仍然把低调用成本作为重要竞争点。

不过,判断一个模型是否真正“便宜”,不能只看每百万Token价格,还要同时考虑:

  • 完成任务需要多少输出Token
  • 是否会因为失败而反复重试
  • 缓存命中率
  • Agent调用次数
  • 推理速度
  • 任务成功率
  • 工具调用稳定性
  • 是否需要人工修正

若一个价格较低的模型需要多次重试,实际项目成本未必更低。

DeepSeek V4与Kimi K3如何比较?

Kimi K3是月之暗面于2026年7月发布的旗舰模型,总参数达到2.8万亿,拥有100万Token上下文,并原生支持图片和视频理解。

Kimi K3重点面向长程编程、知识工作、科学研究与复杂Agent任务,完整模型权重计划于2026年7月27日前发布。

两款模型当前的已知差异如下:

对比方向DeepSeek V4-Pro预览版Kimi K3
总参数1.6万亿2.8万亿
激活参数490亿官方未按相同口径单独列出
上下文100万Token100万Token
视觉输入官方暂未列为核心能力原生支持图片与视频
思考模式支持开启或关闭始终开启,可调思考强度
主要方向推理、编程、Agent长程编程、知识工作、多模态Agent
当前状态预览版权重已开放服务已上线,完整权重拟于7月27日前发布
API输出价格0.87美元/百万Token100元/百万Token

DeepSeek V4-Pro价格来自DeepSeek官方API页面;Kimi K3的官方API价格为缓存命中输入2元、未命中输入20元、输出100元,每100万Token计费。

由于两家采用不同币种、缓存策略、模型规模和产品能力,仅凭标价无法完整判断谁的性价比更高。

若DeepSeek V4正式版在保持现有价格量级的同时,将编程和Agent能力提升至接近顶级闭源模型,其低成本优势会更加明显。

但在原生视觉、视频理解和多模态知识工作方面,Kimi K3目前公开的信息更加完整。

为什么DeepSeek可能选择此时发布正式版?

Kimi K3刚刚发布,千问3.8预览版也已进入阿里云和Qoder,中国大模型市场在2026年7月进入密集更新阶段。

如果DeepSeek选择在这一时间推出V4正式版,可以迅速获得开发者、企业用户和全球开源社区的关注。

不过,DeepSeek自身的产品节奏也提供了一个值得观察的时间节点:

deepseek-chatdeepseek-reasoner两个旧API名称将在 2026年7月24日15:59 UTC 后停止访问。目前它们分别映射至V4-Flash的非思考和思考模式。

旧模型名称下线后,DeepSeek可能进一步统一V4产品与API入口。这个时间安排与“7月底发布正式版”的传闻接近,但二者之间并不存在官方确认的因果关系。

实测视频为什么不能直接视为正式评测?

AI模型的演示视频很容易受到测试条件影响。

同一个模型在以下条件下可能呈现完全不同的结果:

  • 系统提示词不同
  • 思考模式不同
  • 推理Token预算不同
  • 是否允许联网
  • 是否调用代码执行工具
  • 是否进行多次生成后挑选最佳结果
  • 测试环境和依赖不同
  • 是否对提示词进行针对性优化
  • 是否使用内部未公开版本

如果测试者只展示成功案例,而没有公布失败结果,观众也很难判断模型的稳定性。

因此,正式版发布后,更值得关注的是:

  • 官方技术报告
  • 开放模型权重
  • 模型卡和许可证
  • 第三方基准评测
  • 统一提示词下的横向测试
  • 真实代码仓库任务
  • 多次运行成功率
  • API稳定性和延迟

DeepSeek V4正式版还需确认哪些信息?

最终参数是否变化

预览版V4-Pro为1.6万亿总参数、490亿激活参数。正式版是否沿用相同架构和规模,目前未知。

是否继续开放权重

V4预览版已经开放权重,正式版大概率会延续开放路线,但仍需等待官方公告确认具体版本和许可证。

是否支持原生视觉

社区演示中出现3D和视觉开发任务,但官方尚未确认正式版是否加入图像或视频输入。

正式版API价格

现有价格适用于V4-Pro和V4-Flash。正式版发布后是否调整峰谷价格、并发或缓存策略,需要以最新定价页面为准。

正式评测数据

有关超过Fable 5、GPT-5.6或接近Opus 4.8的说法,需要官方技术报告和第三方评测验证。

预览版用户如何升级

开发者需要关注API模型名称、上下文格式、思考历史、工具调用接口和旧模型迁移方案。

现在如何体验DeepSeek V4?

用户目前不必等待传闻中的正式版,即可体验DeepSeek V4预览版。

DeepSeek网页端

用户可以进入DeepSeek官网或网页版,在专家模式与即时模式中使用不同能力的V4模型。

DeepSeek App

最新版DeepSeek App已接入当前旗舰模型,适合普通对话、文件阅读、内容生成和代码任务。

DeepSeek API

开发者可以使用以下模型名称:

deepseek-v4-pro

deepseek-v4-flash

API同时兼容OpenAI ChatCompletions和Anthropic格式。

开放模型权重

V4-Pro和V4-Flash预览版的权重已在DeepSeek Hugging Face官方账号发布,可用于研究、部署和框架适配。

总结

DeepSeek V4正式版的测试视频和实机演示已经在社区流传。

爆料者认为,新版本在编程、Agent、3D内容生成和回答风格方面获得明显改善,综合性能可能接近Claude Opus 4.8,部分特定任务甚至被声称超过Fable 5与GPT-5.6。

不过,截至2026年7月20日,DeepSeek尚未确认正式版发布日期,也没有发布最终技术报告或完整评测。

社区所说的“下周一”指向2026年7月27日,但这一日期仍属于传闻。DeepSeek官网目前继续将V4标注为预览版本,并提醒外界以官方消息为准。

已经得到官方确认的是,V4预览版包含1.6万亿参数的V4-Pro和2840亿参数的V4-Flash,两者均拥有100万Token上下文,并已开放API、技术报告和模型权重。

DeepSeek V4正式版能否真正对Kimi K3和顶级闭源模型形成压力,关键不只在单项演示成绩,还要看正式评测、视觉能力、长任务稳定性、实际价格和开放权重后的社区适配。

在官方公告发布前,更准确的文章口径是:

DeepSeek V4正式版实测内容曝光,传闻或于2026年7月27日发布,但具体日期与性能数据仍待DeepSeek确认。

相关链接