DeepSeek 今天把 V4.1 Flash 放出来了,模型名就叫 deepseek-flash,API 平台已经能调。
结构上是新的一套:552B 参数的 Causal-Encoder-Decoder,输入侧激活 8B、输出侧激活 16B,原生支持多模态视觉理解——不是外挂一个视觉编码器,是从架构里长出来的。DeepSeek 自己给的说法是,这是新结构系列里尺寸最小的一款。
最小的那一款,在各项指标上全面超过了 V4 Pro。这句话的分量比参数表大得多。
跟着来的是路由安排:9 月 14 日 12:00 之后,所有发给 deepseek-v4-pro 的请求会被整体路由到 V4.1 Flash,按 Flash 的单价计费,直到 V4.1 Pro 上线。也就是说旗舰位置暂时空着,中间这几天由一个”小模型”顶着。
价格从今天 12:00 开始换算:空闲时段输入缓存命中 0.02 元、未命中 1 元,输出 4 元,高峰时段整体翻倍。缓存命中和未命中差 50 倍,这个比例决定了很多团队接下来怎么组织 prompt——把系统提示、长文档这些固定部分钉在前缀里,收益是实打实的。
还有一件容易被忽略的:DeepSeek 把原来的快速模式、专家模式、识图模式合并成了一个统一模式。用户不用再手动切换,模型自己判断查询复杂度,检测到图片就激活视觉能力,任务难时才加深处理。三个入口变一个,对普通用户是好事,对做产品接入的人是另一回事——原来靠切模式来控成本的做法,得重新算一遍。
下游反应挺快。OpenCode Go 发布首日就上了 V4.1 Flash,并把用量限额临时提到 4 倍、持续 72 小时。Command Code 也预告了自己的 DeepSeek 集成更新。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






DeepSeek V4.1 Flash 正式发布:552B 新架构,14 号起 V4 Pro 请求全部改道