DeepSeek V4.1 Flash 登陆 WorkBuddy
DeepSeek V4.1 Flash 正式发布以后,WorkBuddy 这边也第一时间接上了。
而且这次不是简单:
模型列表多一个选项。
WorkBuddy 和 CodeBuddy 都属于 DeepSeek 官方首批合作伙伴,目前已经全量接入:
DeepSeek V4.1 Flash。
同时从:
9 月 10 日—9 月 23 日
开启联合首发限时优惠。
当前 V4.1 Flash 在 WorkBuddy 中积分倍率低至:
0.03x。
基本已经进入:
放开跑 Agent 都不太心疼积分
的区间。
一、V4.1 Flash 这次已经不是“小模型”
名字依然叫:
Flash。
但参数其实一点都不小。
DeepSeek V4.1 Flash 是一款:
552B 参数 MoE 模型。
采用新的:
Causal Encoder-Decoder 非对称架构。
处理输入时:
只激活约 8B 参数。
生成输出时:
激活约 16B 参数。
也就是说:
模型整体容量很大。
但真正推理时,不需要让 552B 参数全部一起工作。
DeepSeek 想解决的事情很明确:
旗舰级能力,Flash级成本和速度。
二、它已经全面超过上一代 V4 Pro
更有意思的是:
DeepSeek 这次已经不再把 V4.1 Flash 定位成:
“Pro 的便宜替代版。”
官方表示,经过内部及多方测试:
V4.1 Flash 在:
性能;
费用;
速度;
总任务耗时
等指标上已经全面超过:
DeepSeek V4 Pro。
因此 DeepSeek 已经正式启动:
V4 Pro 退役计划。
北京时间 9 月 14 日 12:00 后:
调用 deepseek-v4-pro 的请求,将自动路由到:
V4.1 Flash。
一直持续到未来:
V4.1 Pro
正式上线。
这其实挺夸张。
一个名字叫 Flash 的模型:
直接把上一代 Pro 淘汰了。
三、V4 Flash 和 Vision Exp 已经正式完成使命
随着 V4.1 Flash 正式上线:
DeepSeek V4 Flash
以及:
DeepSeek V4 Flash Vision Exp
都已经正式退役。
不过为了兼容旧项目:
开发者暂时不需要立刻修改所有代码。
此前使用:
deepseek-v4-flash
或者:
deepseek-v4-flash-vision-exp
的请求,目前会自动路由到:
DeepSeek V4.1 Flash。
所以整个 DeepSeek Flash 产品线已经开始完成:
V4 Flash
+
V4 Flash Vision Exp
↓
统一进入
↓
V4.1 Flash文本和视觉能力终于不需要继续拆成两个模型。
四、原生多模态终于合到一个模型里
V4.1 Flash 现在原生支持:
视觉理解。
也就是说:
图片;
截图;
图表;
网页界面
可以直接进入同一个 Agent 工作流。
比如在 WorkBuddy 中,你可以把:
PDF;
图片;
网页截图;
Office 文件
一起交给 Agent。
然后继续让它:
分析;
研究;
写代码;
生成文档;
制作 PPT;
调用工具。
相比之前:
纯文本模型 + Vision 实验模型
分开使用,
V4.1 Flash 更接近真正统一的:
多模态 Agent 大脑。
五、这次最大的升级之一其实是“缓存更省”
Agent 真正跑起来以后:
成本大头并不只有输出 Token。
还有:
上下文缓存。
一个复杂任务可能连续跑几十轮。
代码;
文件;
系统提示词;
工具定义;
历史执行结果
都会不断留在上下文里。
V4.1 Flash 新架构把 KV Cache 进一步大幅压缩。
相比上一代:
HBM需求降低到1/4。
SSD缓存需求降低到1/8。
和 DeepSeek 最早期架构相比:
KV Cache 甚至已经缩小:
437倍。
这对于 WorkBuddy 这种长程 Agent 特别重要。
因为:
Agent 越能干,越吃上下文。
缓存越省:
就越适合长时间放开跑。
六、WorkBuddy 这次倍率直接压到0.03x
此次联合首发期间:
V4.1 Flash 在 WorkBuddy 中的模型倍率低至:
0.03x。
活动时间:
9月10日—9月23日。
简单理解:
本来烧 100 积分级别的模型任务。
在对应倍率下:
实际积分成本会非常低。
再加上 WorkBuddy 当前体验版本身还处在:
限时全模型开放
阶段,
所以这段时间特别适合拿 V4.1 Flash 跑一些:
大型研究;
代码仓库;
复杂办公;
长文档;
网页开发;
Agent 自动化。
别只拿它:
问“你好”。
七、特别适合拿来跑这些“烧Token”的活
如果要测试 V4.1 Flash,我更建议直接上真实任务。
大型代码仓库
扫描整个项目,分析高风险技术债,修复优先级最高的问题,并持续运行测试验证结果。
数据和报告
读取这些Excel和PDF,交叉分析核心指标,再生成管理层汇报PPT。
前端项目
完成整个网站移动端适配,逐页运行和检查,并修复视觉和交互问题。
深度研究
搜集指定行业资料,交叉验证来源,整理竞品矩阵并生成完整研究报告。
多模态任务
根据网页截图找出UI问题,同时检查代码仓库并直接修改对应组件。
这种任务才真正能测出:
V4.1 Flash 到底是不是能替掉 Pro。
八、真正值得看的,是Flash正在吞掉Pro
最近几家模型厂商都有一个非常明显的趋势:
Flash 模型越来越不像过去的:
廉价低配版。
它们正在通过:
MoE;
稀疏计算;
缓存优化;
更大规模RL后训练;
更高智能密度
把旗舰能力逐渐往低成本模型里压。
DeepSeek V4.1 Flash 更直接:
上一代 Pro 都准备退役了。
这可能意味着 Agent 时代的模型分层方式也在变化。
以前:
Flash
→ 简单任务
Pro
→ 复杂任务未来可能逐渐变成:
Flash
→ 绝大多数真实任务
下一代 Pro
→ 极端复杂任务真正需要旗舰模型的任务比例,反而会越来越低。
结语
DeepSeek V4.1 Flash 这次可以记住几件事:
552B MoE。
输入激活8B。
输出激活16B。
原生多模态。
KV Cache进一步大幅缩小。
V4 Flash正式退役。
V4 Flash Vision Exp正式退役。
V4 Pro也将在9月14日开始逐步退出。
而 WorkBuddy 已经作为官方合作伙伴完成全量接入。
9月10日—9月23日
联合首发期间:
积分倍率低至0.03x。
真正有意思的还是:
DeepSeek 现在已经不再把 Flash 当成:
“便宜但弱一点的版本。”
而是直接让它去替代:
上一代 Pro。
Flash 的价格。
Pro 的能力。
而真正的新 Pro:
V4.1 Pro
还在后面。
这波可以先在 WorkBuddy 里狠狠蹬两周了。
相关链接
WorkBuddy 体验 / 邀请入口
https://www.workbuddy.cn/events/invite?inviteCode=mxww83dvgg8
WorkBuddy 官网
WorkBuddy 套餐与模型说明
https://www.workbuddy.cn/pricing/
DeepSeek V4.1 Flash 官方发布
https://deepseek.com/news/deepseek-v4-1-flash/
DeepSeek 官网
DeepSeek API
https://platform.deepseek.com/
DeepSeek API 文档
https://api-docs.deepseek.com/
标签






评论 0
最新评论登录后发布评论并参与互动。
暂无评论,欢迎抢沙发。