推荐Lovart 中文版 - 一站式 AI 设计平台推荐一人企业Vibe Coding社区!热门AI设计工具新品免费AI编程工具 Trae - 智能编码助手Seedance2.5已上线新用户注册即领免费算力
UIED.CN今天偷学哪一招,朋友

DeepSeek V4.1 Flash 登陆 WorkBuddy

DeepSeek V4.1 Flash 正式发布以后,WorkBuddy 这边也第一时间接上了。


image.png而且这次不是简单:

模型列表多一个选项。

WorkBuddy 和 CodeBuddy 都属于 DeepSeek 官方首批合作伙伴,目前已经全量接入:

DeepSeek V4.1 Flash。

同时从:

9 月 10 日—9 月 23 日

开启联合首发限时优惠。

当前 V4.1 Flash 在 WorkBuddy 中积分倍率低至:

0.03x。

基本已经进入:

放开跑 Agent 都不太心疼积分

的区间。




一、V4.1 Flash 这次已经不是“小模型”

名字依然叫:

Flash。

但参数其实一点都不小。

DeepSeek V4.1 Flash 是一款:

552B 参数 MoE 模型。

采用新的:

Causal Encoder-Decoder 非对称架构。

处理输入时:

只激活约 8B 参数。

生成输出时:

激活约 16B 参数。

也就是说:

模型整体容量很大。

但真正推理时,不需要让 552B 参数全部一起工作。

DeepSeek 想解决的事情很明确:

旗舰级能力,Flash级成本和速度。




二、它已经全面超过上一代 V4 Pro

更有意思的是:

DeepSeek 这次已经不再把 V4.1 Flash 定位成:

“Pro 的便宜替代版。”

官方表示,经过内部及多方测试:

V4.1 Flash 在:

性能;

费用;

速度;

总任务耗时

等指标上已经全面超过:

DeepSeek V4 Pro。

因此 DeepSeek 已经正式启动:

V4 Pro 退役计划。

北京时间 9 月 14 日 12:00 后:

调用 deepseek-v4-pro 的请求,将自动路由到:

V4.1 Flash。

一直持续到未来:

V4.1 Pro

正式上线。

这其实挺夸张。

一个名字叫 Flash 的模型:

直接把上一代 Pro 淘汰了。




三、V4 Flash 和 Vision Exp 已经正式完成使命

随着 V4.1 Flash 正式上线:

DeepSeek V4 Flash

以及:

DeepSeek V4 Flash Vision Exp

都已经正式退役。

不过为了兼容旧项目:

开发者暂时不需要立刻修改所有代码。

此前使用:

deepseek-v4-flash

或者:

deepseek-v4-flash-vision-exp

的请求,目前会自动路由到:

DeepSeek V4.1 Flash。

所以整个 DeepSeek Flash 产品线已经开始完成:

V4 Flash
+
V4 Flash Vision Exp
↓
统一进入
↓
V4.1 Flash

文本和视觉能力终于不需要继续拆成两个模型。




四、原生多模态终于合到一个模型里

V4.1 Flash 现在原生支持:

视觉理解。

也就是说:

图片;

截图;

图表;

网页界面

可以直接进入同一个 Agent 工作流。

比如在 WorkBuddy 中,你可以把:

PDF;

图片;

网页截图;

Office 文件

一起交给 Agent。

然后继续让它:

分析;

研究;

写代码;

生成文档;

制作 PPT;

调用工具。

相比之前:

纯文本模型 + Vision 实验模型

分开使用,

V4.1 Flash 更接近真正统一的:

多模态 Agent 大脑。




五、这次最大的升级之一其实是“缓存更省”

Agent 真正跑起来以后:

成本大头并不只有输出 Token。

还有:

上下文缓存。

一个复杂任务可能连续跑几十轮。

代码;

文件;

系统提示词;

工具定义;

历史执行结果

都会不断留在上下文里。

V4.1 Flash 新架构把 KV Cache 进一步大幅压缩。

相比上一代:

HBM需求降低到1/4。

SSD缓存需求降低到1/8。

和 DeepSeek 最早期架构相比:

KV Cache 甚至已经缩小:

437倍。

这对于 WorkBuddy 这种长程 Agent 特别重要。

因为:

Agent 越能干,越吃上下文。

缓存越省:

就越适合长时间放开跑。




六、WorkBuddy 这次倍率直接压到0.03x

此次联合首发期间:

V4.1 Flash 在 WorkBuddy 中的模型倍率低至:

0.03x。

活动时间:

9月10日—9月23日。

简单理解:

本来烧 100 积分级别的模型任务。

在对应倍率下:

实际积分成本会非常低。

再加上 WorkBuddy 当前体验版本身还处在:

限时全模型开放

阶段,

所以这段时间特别适合拿 V4.1 Flash 跑一些:

大型研究;

代码仓库;

复杂办公;

长文档;

网页开发;

Agent 自动化。

别只拿它:

问“你好”。




七、特别适合拿来跑这些“烧Token”的活

如果要测试 V4.1 Flash,我更建议直接上真实任务。

大型代码仓库

扫描整个项目,分析高风险技术债,修复优先级最高的问题,并持续运行测试验证结果。

数据和报告

读取这些Excel和PDF,交叉分析核心指标,再生成管理层汇报PPT。

前端项目

完成整个网站移动端适配,逐页运行和检查,并修复视觉和交互问题。

深度研究

搜集指定行业资料,交叉验证来源,整理竞品矩阵并生成完整研究报告。

多模态任务

根据网页截图找出UI问题,同时检查代码仓库并直接修改对应组件。

这种任务才真正能测出:

V4.1 Flash 到底是不是能替掉 Pro。




八、真正值得看的,是Flash正在吞掉Pro

最近几家模型厂商都有一个非常明显的趋势:

Flash 模型越来越不像过去的:

廉价低配版。

它们正在通过:

MoE;

稀疏计算;

缓存优化;

更大规模RL后训练;

更高智能密度

把旗舰能力逐渐往低成本模型里压。

DeepSeek V4.1 Flash 更直接:

上一代 Pro 都准备退役了。

这可能意味着 Agent 时代的模型分层方式也在变化。

以前:

Flash
→ 简单任务

Pro
→ 复杂任务

未来可能逐渐变成:

Flash
→ 绝大多数真实任务

下一代 Pro
→ 极端复杂任务

真正需要旗舰模型的任务比例,反而会越来越低。




结语

DeepSeek V4.1 Flash 这次可以记住几件事:

552B MoE。

输入激活8B。

输出激活16B。

原生多模态。

KV Cache进一步大幅缩小。

V4 Flash正式退役。

V4 Flash Vision Exp正式退役。

V4 Pro也将在9月14日开始逐步退出。

而 WorkBuddy 已经作为官方合作伙伴完成全量接入。

9月10日—9月23日

联合首发期间:

积分倍率低至0.03x。

真正有意思的还是:

DeepSeek 现在已经不再把 Flash 当成:

“便宜但弱一点的版本。”

而是直接让它去替代:

上一代 Pro。

Flash 的价格。

Pro 的能力。

而真正的新 Pro:

V4.1 Pro

还在后面。

这波可以先在 WorkBuddy 里狠狠蹬两周了。




相关链接

WorkBuddy 体验 / 邀请入口

https://www.workbuddy.cn/events/invite?inviteCode=mxww83dvgg8

WorkBuddy 官网

https://www.workbuddy.cn/

WorkBuddy 套餐与模型说明

https://www.workbuddy.cn/pricing/

DeepSeek V4.1 Flash 官方发布

https://deepseek.com/news/deepseek-v4-1-flash/

DeepSeek 官网

https://www.deepseek.com/

DeepSeek API

https://platform.deepseek.com/

DeepSeek API 文档

https://api-docs.deepseek.com/









标签

评论 0

最新评论

登录后发布评论并参与互动。

暂无评论,欢迎抢沙发。

推荐阅读

查看更多