AI+ 2025-01-20

DeepSeek 发布 R1 并全面开源:中国 AI 的分水岭时刻

2025 年 1 月 20 日,杭州深度求索(DeepSeek)发布推理模型 DeepSeek-R1 及 R1-Zero,性能对标 OpenAI o1,权重以 MIT 协议完全开源,并提供 1.5B 至 70B 的蒸馏小模型,官方论文同时公布了强化学习训练细节。

为什么重要

  • 性能与价格的双重冲击:R1 在数学、代码等推理任务上达到第一梯队水平,而 API 价格只有对标产品的零头
  • 彻底开源:MIT 协议允许商用、蒸馏、二次开发,全球开发者可以自由部署
  • 训练路线公开:论文公布了纯强化学习(R1-Zero)的训练细节,为行业提供了宝贵的研究样本

R1 的发布在一周内引发全球连锁反应(详见 1 月 27 日的市场震动),也让"中国开源模型"成为 2025 年全球 AI 叙事的关键词。

对企业的启示

R1 及其蒸馏模型让私有化部署一流推理模型的成本大幅下降——在本地服务器上运行 7B/14B 级别的蒸馏版 R1,即可获得可观的推理与摘要能力,敏感数据完全不出内网。这正是 ProMen AI+ 业务为客户交付的主流方案之一:用开源模型 + 私有化部署,把 AI 能力嵌入企业已有系统。

继续阅读