AI+ 2026-09-10
DeepSeek 发布 V4.1-Flash:性能全面超越 V4-Pro,老版本有序退役
2026 年 9 月 10 日,DeepSeek 官方发布新架构多模态模型 V4.1-Flash:官方口径为性能、成本、速度全面超越 V4-Pro,且 off-peak(闲时)价格再减半。更值得注意的退役安排:自 9 月 14 日起,`deepseek-v4-pro` 的请求将全部路由至 V4.1-Flash(V4-Pro 有序退役)——发布即替代,老用户无感迁移。
三个关键信息
1. 性能与成本双优
V4.1-Flash 是 DeepSeek 继 V4-Pro(1.6T 总参)、V4-Flash(284B)之后的又一款新架构模型,官方称三项指标全面超越上一代旗舰。结合其一贯的定价策略(上代 API 输入低至每百万 token 美分级),off-peak 再减半意味着批量处理任务的单位成本再下探一档。
2. 「发布即替代」的托管哲学
与多数厂商「新旧版本并存、逐步 sunset」不同,DeepSeek 选择为旧模型请求自动路由到新模型——API 兼容性由官方兜底。对企业用户而言,这几乎消除了「升级成本」,但也意味着无法锁定旧版本行为:对输出一致性有强要求的场景需自行做回归测试。
3. 多模态补全
V4.1-Flash 为多模态模型,补上了 V4 系列的视觉能力短板(此前仅 V4-Flash-Vision-Exp 实验版)。
对企业的启示
DeepSeek 的「发布即替代 + 闲时减半」组合,使其成为批量文档处理、离线分析类任务的性价比首选之一——闲时调度(如夜间批处理)可把成本压到极低。9 月 14 日切换窗口前,正在使用 deepseek-v4-pro 的团队建议跑一轮回归测试。ProMen 可为企业评估 DeepSeek V4.1-Flash 在自身场景的表现与云端/私有化部署成本对比。