模型原理与推理DeepSeek-R1 的开放推理到底开放了什么:RL、蒸馏与生产成本边界正式 R1 不是纯 RL,Distill 不是 671B 的量化副本,首发 API 也不等于权重能力;生产选型必须分别核算训练路径、接口契约、许可和任务总成本。发布 2025/01/22更新 2025/02/10DeepSeek-R1推理模型强化学习模型蒸馏模型部署