Folia
← 返回头版

DeepSeek V4.1 Flash 模型正式发布:性能全面超越 V4 Pro、降价最高六成

DeepSeek 正式发布 V4.1 Flash 模型,这是其新模型结构系列中最小尺寸的版本,具备原生多模态视觉理解能力1。该模型采用全新 Causal-Encoder-Decoder 结构,为 552B 参数的 MoE 模型,输入激活仅 8B、输出激活 16B,在成本上显著低于同尺寸已知模型1。相比初代模型,V4.1 Flash 的 KV Cache 缩小至原来的 1/437,对 HBM 的需求降至 1/4,对 SSD 的需求则下降到 1/81。

在基准测试中,V4.1 Flash 在性能、费用、速度和总用时等各项指标上全面超越 V4 Pro1。新模型价格最高下降 60%,新价格将于 2026 年 9 月 10 日 12:00 开始生效1。DeepSeek 计划从北京时间 2026 年 9 月 14 日 12:00 之后,将 deepseek-v4-pro 的所有请求路由至 V4.1 Flash,有序下线 V4 Pro 模型1。


评论