AI+ 2026-04-24

DeepSeek 开源 V4:推理成本再降一个量级,长上下文成默认

2026 年 4 月 24 日,DeepSeek 发布并开源 DeepSeek-V4 Preview:V4-Pro(总参数 1.6T、激活 49B)与 V4-Flash(284B、激活 13B)两档,采用 DSA 稀疏注意力架构,默认 1M token 上下文,继续 MIT 协议开源。官方称 V4 级推理成本较上代下降约 10 倍,发布即登顶开源模型榜单,并原生适配 Claude Code 等主流智能体工具。

技术路线的延续与进化

DeepSeek 一直是"效率路线"的旗手:从 V3 的 FP8 训练、R1 的纯强化学习,到 V3.2 的稀疏注意力降本,V4 把稀疏注意力(DSA)推向默认配置——处理长文档的成本曲线被大幅压平。Flash 版本则让消费级硬件也能跑起高吞吐推理。

对行业的意义

  • 长上下文平民化:1M 上下文成为开源默认能力,整本书、整个代码库、全年合同档案的直读分析不再昂贵
  • 开源逼近闭源:V4 在推理与 Agent 基准上与闭源旗舰差距进一步缩小
  • 价格压力传导:开源成本下降持续挤压闭源 API 定价,最终受益的是所有应用层企业

对企业的启示

按 DeepSeek 的成本曲线,"把企业全部历史文档喂给 AI 做问答与审计"从概念变成了预算内的项目。ProMen 已在企业知识库方案中适配 DeepSeek V4 系列,欢迎了解私有化部署的软硬件配置与成本测算。

继续阅读