471/4
DeepSeek V4.1 Flash 上线,已适配 Harness
DeepSeek 又更新了。
刚刚,DeepSeek V4.1 Flash 正式发布。
这次不只是模型能力升级,而是把 Agent 最现实的一个问题也一起优化了:成本。
几个重点:
552B MoE 全新架构
输入仅激活 8B,输出激活 16B,该省算力的时候省,该上强度的时候上。
原生多模态视觉理解
Flash 系列也正式补上视觉能力。
Agent 能力继续提升
官方数据显示,V4.1 Flash 在 Agentic Benchmark 上甚至超过了 V4 Pro。
KV Cache 大幅压缩
相比上一代:
HBM 需求降至 1/4,SSD 需求降至 1/8;相比初代,KV Cache 缩小 437 倍。
API 同步降价
新模型直接调用 deepseek-flash,继续支持峰谷计价,闲时价格只有高峰的一半。
另外,V4 Pro 也准备逐步退出,9 月 14 日起相关 API 请求将逐步路由到 V4.1 Flash。
这次 DeepSeek 的思路已经很明显了:
模型不只是要更强,还要让 Agent 真正跑得起、跑得久、跑得便宜。









评论 0
最新评论登录后发布评论并参与互动。
暂无评论,欢迎抢沙发。