模型介绍
DeepSeek-R1:技术亮点 📈 后训练中的大规模强化学习 🏆 凭借极少的标注数据实现显著的性能提升 🔢 数学、代码及推理任务与 OpenAI-o1 相当
查看介绍来源模型基础信息
- 厂商
- DeepSeek
- 模型类型
- 文本与多模态
- 能接收什么
- 文本可以发给它的内容类型
- 能产出什么
- 文本它能生成的内容类型
- 能调工具吗
- 可以能不能自动调用外部函数、查资料、执行动作
- 它会做什么
- 会聊天 · 支持缓存省钱 · 擅长推理 · 可以设定角色 · 回答风格可调 · 会写字 · 会调工具
- 这些资料是哪个地区的
- 中国大陆厂商专门为中国大陆公布的资料。
它还叫这些名字(160 条)
DEEPSEEK R1DEEPSEEK R1(alibaba-model-studio-cn · cn_mainland)DEEPSEEK R1(azure · international)DEEPSEEK R1(azure-ai · international)DEEPSEEK R1(azure-cognitive-services · international)DEEPSEEK R1(deepseek-api-cn · international)DEEPSEEK R1(nano-gpt · international)DEEPSEEK R1(qiniu-ai · international)DEEPSEEK R1(snowflake · international)DEEPSEEK R1(snowflake-cortex · international)DEEPSEEK-R1DEEPSEEK-R1(alibaba-model-studio-cn · cn_mainland)DEEPSEEK-R1(azure · international)DEEPSEEK-R1(azure-ai · international)DEEPSEEK-R1(azure-cognitive-services · international)DEEPSEEK-R1(deepseek-api-cn · international)DEEPSEEK-R1(nano-gpt · international)DEEPSEEK-R1(qiniu-ai · international)DEEPSEEK-R1(snowflake · international)DEEPSEEK-R1(snowflake-cortex · international)DEEPSEEKR1DEEPSEEKR1(alibaba-model-studio-cn · cn_mainland)DEEPSEEKR1(azure · international)DEEPSEEKR1(azure-ai · international)DEEPSEEKR1(azure-cognitive-services · international)DEEPSEEKR1(deepseek-api-cn · international)DEEPSEEKR1(nano-gpt · international)DEEPSEEKR1(qiniu-ai · international)DEEPSEEKR1(snowflake · international)DEEPSEEKR1(snowflake-cortex · international)DEEPSEEK_R1DEEPSEEK_R1(alibaba-model-studio-cn · cn_mainland)DEEPSEEK_R1(azure · international)DEEPSEEK_R1(azure-ai · international)DEEPSEEK_R1(azure-cognitive-services · international)DEEPSEEK_R1(deepseek-api-cn · international)DEEPSEEK_R1(nano-gpt · international)DEEPSEEK_R1(qiniu-ai · international)DEEPSEEK_R1(snowflake · international)DEEPSEEK_R1(snowflake-cortex · international)DeepSeek R1DeepSeek R1(alibaba-model-studio-cn · cn_mainland)DeepSeek R1(azure · international)DeepSeek R1(azure-ai · international)DeepSeek R1(azure-cognitive-services · international)DeepSeek R1(deepseek-api-cn · international)DeepSeek R1(nano-gpt · international)DeepSeek R1(qiniu-ai · international)DeepSeek R1(snowflake · international)DeepSeek R1(snowflake-cortex · international)DeepSeek r1DeepSeek r1(alibaba-model-studio-cn · cn_mainland)DeepSeek r1(azure · international)DeepSeek r1(azure-ai · international)DeepSeek r1(azure-cognitive-services · international)DeepSeek r1(deepseek-api-cn · international)DeepSeek r1(nano-gpt · international)DeepSeek r1(qiniu-ai · international)DeepSeek r1(snowflake · international)DeepSeek r1(snowflake-cortex · international)DeepSeek-R1DeepSeek-R1(alibaba-model-studio-cn · cn_mainland)DeepSeek-R1(azure · international)DeepSeek-R1(azure-ai · international)DeepSeek-R1(azure-cognitive-services · international)DeepSeek-R1(deepseek-api-cn · international)DeepSeek-R1(nano-gpt · international)DeepSeek-R1(qiniu-ai · international)DeepSeek-R1(snowflake · international)DeepSeek-R1(snowflake-cortex · international)DeepSeek-r1DeepSeek-r1(alibaba-model-studio-cn · cn_mainland)DeepSeek-r1(azure · international)DeepSeek-r1(azure-ai · international)DeepSeek-r1(azure-cognitive-services · international)DeepSeek-r1(deepseek-api-cn · international)DeepSeek-r1(nano-gpt · international)DeepSeek-r1(qiniu-ai · international)DeepSeek-r1(snowflake · international)DeepSeek-r1(snowflake-cortex · international)DeepSeekR1DeepSeekR1(alibaba-model-studio-cn · cn_mainland)DeepSeekR1(azure · international)DeepSeekR1(azure-ai · international)DeepSeekR1(azure-cognitive-services · international)DeepSeekR1(deepseek-api-cn · international)DeepSeekR1(nano-gpt · international)DeepSeekR1(qiniu-ai · international)DeepSeekR1(snowflake · international)DeepSeekR1(snowflake-cortex · international)DeepSeek_R1DeepSeek_R1(alibaba-model-studio-cn · cn_mainland)DeepSeek_R1(azure · international)DeepSeek_R1(azure-ai · international)DeepSeek_R1(azure-cognitive-services · international)DeepSeek_R1(deepseek-api-cn · international)DeepSeek_R1(nano-gpt · international)DeepSeek_R1(qiniu-ai · international)DeepSeek_R1(snowflake · international)DeepSeek_R1(snowflake-cortex · international)DeepSeek_r1DeepSeek_r1(alibaba-model-studio-cn · cn_mainland)DeepSeek_r1(azure · international)DeepSeek_r1(azure-ai · international)DeepSeek_r1(azure-cognitive-services · international)DeepSeek_r1(deepseek-api-cn · international)DeepSeek_r1(nano-gpt · international)DeepSeek_r1(qiniu-ai · international)DeepSeek_r1(snowflake · international)DeepSeek_r1(snowflake-cortex · international)DeepSeekr1DeepSeekr1(alibaba-model-studio-cn · cn_mainland)DeepSeekr1(azure · international)DeepSeekr1(azure-ai · international)DeepSeekr1(azure-cognitive-services · international)DeepSeekr1(deepseek-api-cn · international)DeepSeekr1(nano-gpt · international)DeepSeekr1(qiniu-ai · international)DeepSeekr1(snowflake · international)DeepSeekr1(snowflake-cortex · international)deepseek r1deepseek r1(alibaba-model-studio-cn · cn_mainland)deepseek r1(azure · international)deepseek r1(azure-ai · international)deepseek r1(azure-cognitive-services · international)deepseek r1(deepseek-api-cn · international)deepseek r1(nano-gpt · international)deepseek r1(qiniu-ai · international)deepseek r1(snowflake · international)deepseek r1(snowflake-cortex · international)deepseek-r1deepseek-r1(alibaba-model-studio-cn · cn_mainland)deepseek-r1(azure · international)deepseek-r1(azure-ai · international)deepseek-r1(azure-cognitive-services · international)deepseek-r1(deepseek-api-cn · international)deepseek-r1(nano-gpt · international)deepseek-r1(qiniu-ai · international)deepseek-r1(snowflake · international)deepseek-r1(snowflake-cortex · international)deepseek_r1deepseek_r1(alibaba-model-studio-cn · cn_mainland)deepseek_r1(azure · international)deepseek_r1(azure-ai · international)deepseek_r1(azure-cognitive-services · international)deepseek_r1(deepseek-api-cn · international)deepseek_r1(nano-gpt · international)deepseek_r1(qiniu-ai · international)deepseek_r1(snowflake · international)deepseek_r1(snowflake-cortex · international)deepseekr1deepseekr1(alibaba-model-studio-cn · cn_mainland)deepseekr1(azure · international)deepseekr1(azure-ai · international)deepseekr1(azure-cognitive-services · international)deepseekr1(deepseek-api-cn · international)deepseekr1(nano-gpt · international)deepseekr1(qiniu-ai · international)deepseekr1(snowflake · international)deepseekr1(snowflake-cortex · international)不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
官方价格
| 计价项 | 适用范围 | 官方价格 |
|---|
| 缓存读取 | 中国大陆 | 0.8 CNY/ 1,000,000 token |
| 输入 | 中国大陆 | 4 CNY/ 1,000,000 token |
| 输出 | 中国大陆 | 16 CNY/ 1,000,000 token |
| 输入 | 全球 | 0.55 USD/ 1,000,000 token |
| 输出 | 全球 | 2.19 USD/ 1,000,000 token |
它有多强
成绩来自 Epoch AI, AI Benchmarking Hub (2026)8 / 20 项20 项评测里,这个模型测过 8 项
- 模型自己的成绩
- 6 项
- 配上工具的成绩
- 2 项
- 换不同设置跑出的成绩
- 8 次
这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。
还有 12 项评测没测过这个模型
CyBenchDeepResearchBenchGDPvalOSWorldOSWorld 2SWE-bench VerifiedTerminal-BenchFrontierMathHumanity's Last ExamMirrorCodeSimpleQA VerifiedVideo-MME可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。
中等综合能力档位
入门中等强第一梯队
57%在同批模型里的位置
这个档位是怎么来的
按第三方评测机构 Epoch 的公开成绩,看它在同批模型里排在什么位置,不是我们自己打的分。新模型加进来时,这个位置会小幅变动。
模型自己的成绩
同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。
ARC-AGI-2推理
新颖抽象规则归纳与泛化能力。
默认档1.30%
参加这项评测的全部模型 中位 9.86% · 最高 95.0% · 共 203 个成绩
每题成本 0.08 训练算力 3.50 × 10^24 FLOP评测于 2025年1月20日来源 DeepSeek ↗许可 CC BY 4.0
GPQA Diamond推理
研究生级科学问答,衡量高难知识推理。
默认档69.2%±
参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩
多次评分最佳 71.7%训练算力 3.50 × 10^24 FLOP评测于 2025年5月27日来源 DeepSeek ↗看逐题日志 ↗许可 CC BY 4.0
LiveBench推理版本 LiveBench-2024-11-25
使用持续更新题目降低污染风险的综合能力评测。
默认档71.6
参加这项评测的全部模型 中位 52.4 · 最高 82.3 · 共 52 个成绩
训练算力 3.50 × 10^24 FLOP评测于 2025年1月20日来源 DeepSeek ↗许可 CC BY 4.0
MATH Level 5数学
高难竞赛数学问题正确率。
默认档93.1%±
参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩
多次评分最佳 93.1%训练算力 3.50 × 10^24 FLOP评测于 2025年2月1日来源 DeepSeek ↗看逐题日志 ↗许可 CC BY 4.0
SimpleBench推理
以多次作答平均分衡量常识与推理能力。
默认档30.9%
参加这项评测的全部模型 中位 49.5% · 最高 81.9% · 共 102 个成绩
训练算力 3.50 × 10^24 FLOP评测于 2025年1月20日来源 DeepSeek ↗许可 CC BY 4.0
配上 Agent 能做到什么
这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。
Aider Polyglot编程
多语言代码编辑任务;结果包含 Aider 执行框架影响。
默认档56.9%
参加这项评测的全部模型 中位 53.8% · 最高 88.0% · 共 71 个成绩
训练算力 3.50 × 10^24 FLOP评测于 2025年1月20日来源 DeepSeek ↗许可 Apache License 2.0
METR Time Horizons任务执行
在 METR 任务分布中达到约 50% 成功率的任务时长(分钟);结果包含评测执行环境。
默认档26.9
参加这项评测的全部模型 中位 55.1 · 最高 1044.8 · 共 50 个成绩
训练算力 3.50 × 10^24 FLOP评测于 2025年1月20日来源 DeepSeek ↗许可 CC BY 4.0