模型索引
深度求索·DeepSeek V / R

DeepSeek-R1

以大规模强化学习塑造推理能力,并开放模型权重与蒸馏版本。

当前版本推理编码开放权重
模型编号018
发布日期
2025-01-20
组织
DeepSeek
家族
DeepSeek V / R
01

规格概览

仅展示已有公开资料的规格。

总参数
671B
激活参数
37B
架构
MoE
上下文
128K
输入模态
文本
开放权重
许可证
MIT
状态
当前版本
02

概览

概览

以大规模强化学习塑造推理能力,并开放模型权重与蒸馏版本。

为什么重要

R1 让开放权重推理模型进入全球主流比较,也推动了对 RL 训练路线的快速复现。

03

相对前代的变化

对比 DeepSeek-V3

前代DeepSeek-V3671B · 128K ctx
当前DeepSeek-R1671B · 128K ctx
新增能力 推理 思维链
04

架构与能力

注意力机制

MLA

主要能力

推理编码思维链
05

发布历史

开放权重

DeepSeek-R1 与蒸馏模型开放权重。

查看原文
06

相关模型

点击卡片查看相关模型。

07

来源