模型介绍
用于多步分析、数学、编程和工具的 DeepSeek 推理模型
查看介绍来源模型基础信息
- 厂商
- DeepSeek
- 模型类型
- 文本与多模态
- 能接收什么
- 文本可以发给它的内容类型
- 能产出什么
- 文本它能生成的内容类型
- 能调工具吗
- 可以能不能自动调用外部函数、查资料、执行动作
- 它会做什么
- 会聊天 · 擅长推理 · 支持结构化输出 · 可以设定角色 · 回答风格可调 · 会写字 · 会调工具
- 这些资料是哪个地区的
- 中国大陆厂商专门为中国大陆公布的资料。
它还叫这些名字(80 条)
DEEPSEEK R1 0528DEEPSEEK R1 0528(alibaba-model-studio-cn · cn_mainland)DEEPSEEK R1 0528(cortecs · international)DEEPSEEK R1 0528(lambda-ai · international)DEEPSEEK R1 0528(qiniu-ai · international)DEEPSEEK-R1-0528DEEPSEEK-R1-0528(alibaba-model-studio-cn · cn_mainland)DEEPSEEK-R1-0528(cortecs · international)DEEPSEEK-R1-0528(lambda-ai · international)DEEPSEEK-R1-0528(qiniu-ai · international)DEEPSEEKR10528DEEPSEEKR10528(alibaba-model-studio-cn · cn_mainland)DEEPSEEKR10528(cortecs · international)DEEPSEEKR10528(lambda-ai · international)DEEPSEEKR10528(qiniu-ai · international)DEEPSEEK_R1_0528DEEPSEEK_R1_0528(alibaba-model-studio-cn · cn_mainland)DEEPSEEK_R1_0528(cortecs · international)DEEPSEEK_R1_0528(lambda-ai · international)DEEPSEEK_R1_0528(qiniu-ai · international)DeepSeek R1 0528DeepSeek R1 0528(alibaba-model-studio-cn · cn_mainland)DeepSeek R1 0528(cortecs · international)DeepSeek R1 0528(lambda-ai · international)DeepSeek R1 0528(qiniu-ai · international)DeepSeek r1 0528DeepSeek r1 0528(alibaba-model-studio-cn · cn_mainland)DeepSeek r1 0528(cortecs · international)DeepSeek r1 0528(lambda-ai · international)DeepSeek r1 0528(qiniu-ai · international)DeepSeek-R1-0528DeepSeek-R1-0528(alibaba-model-studio-cn · cn_mainland)DeepSeek-R1-0528(cortecs · international)DeepSeek-R1-0528(lambda-ai · international)DeepSeek-R1-0528(qiniu-ai · international)DeepSeek-r1-0528DeepSeek-r1-0528(alibaba-model-studio-cn · cn_mainland)DeepSeek-r1-0528(cortecs · international)DeepSeek-r1-0528(lambda-ai · international)DeepSeek-r1-0528(qiniu-ai · international)DeepSeekR10528DeepSeekR10528(alibaba-model-studio-cn · cn_mainland)DeepSeekR10528(cortecs · international)DeepSeekR10528(lambda-ai · international)DeepSeekR10528(qiniu-ai · international)DeepSeek_R1_0528DeepSeek_R1_0528(alibaba-model-studio-cn · cn_mainland)DeepSeek_R1_0528(cortecs · international)DeepSeek_R1_0528(lambda-ai · international)DeepSeek_R1_0528(qiniu-ai · international)DeepSeek_r1_0528DeepSeek_r1_0528(alibaba-model-studio-cn · cn_mainland)DeepSeek_r1_0528(cortecs · international)DeepSeek_r1_0528(lambda-ai · international)DeepSeek_r1_0528(qiniu-ai · international)DeepSeekr10528DeepSeekr10528(alibaba-model-studio-cn · cn_mainland)DeepSeekr10528(cortecs · international)DeepSeekr10528(lambda-ai · international)DeepSeekr10528(qiniu-ai · international)deepseek r1 0528deepseek r1 0528(alibaba-model-studio-cn · cn_mainland)deepseek r1 0528(cortecs · international)deepseek r1 0528(lambda-ai · international)deepseek r1 0528(qiniu-ai · international)deepseek-r1-0528deepseek-r1-0528(alibaba-model-studio-cn · cn_mainland)deepseek-r1-0528(cortecs · international)deepseek-r1-0528(lambda-ai · international)deepseek-r1-0528(qiniu-ai · international)deepseek_r1_0528deepseek_r1_0528(alibaba-model-studio-cn · cn_mainland)deepseek_r1_0528(cortecs · international)deepseek_r1_0528(lambda-ai · international)deepseek_r1_0528(qiniu-ai · international)deepseekr10528deepseekr10528(alibaba-model-studio-cn · cn_mainland)deepseekr10528(cortecs · international)deepseekr10528(lambda-ai · international)deepseekr10528(qiniu-ai · international)不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
官方价格
| 计价项 | 适用范围 | 官方价格 |
|---|
| 输入 | 中国大陆 | 4 CNY/ 1,000,000 token |
| 输出 | 中国大陆 | 16 CNY/ 1,000,000 token |
| 缓存读取 | 全球 | 0.163 USD/ 1,000,000 token |
| 输入 | 全球 | 0.652 USD/ 1,000,000 token |
| 输出 | 全球 | 2.57 USD/ 1,000,000 token |
它有多强
成绩来自 Epoch AI, AI Benchmarking Hub (2026)7 / 20 项20 项评测里,这个模型测过 7 项
- 模型自己的成绩
- 4 项
- 配上工具的成绩
- 3 项
- 换不同设置跑出的成绩
- 7 次
这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。
还有 13 项评测没测过这个模型
CyBenchGDPvalOSWorldOSWorld 2SWE-bench VerifiedTerminal-BenchEpoch Capabilities IndexFrontierMathHumanity's Last ExamLiveBenchMirrorCodeSimpleQA VerifiedVideo-MME可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。
这个模型还没有可比的综合成绩,下面是它的单项成绩。
模型自己的成绩
同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。
ARC-AGI-2推理
新颖抽象规则归纳与泛化能力。
默认档1.12%
参加这项评测的全部模型 中位 9.86% · 最高 95.0% · 共 203 个成绩
每题成本 0.0527 训练算力 4.02 × 10^24 FLOP评测于 2025年5月28日来源 DeepSeek ↗许可 CC BY 4.0
GPQA Diamond推理
研究生级科学问答,衡量高难知识推理。
默认档76.3%±
参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩
多次评分最佳 76.3%训练算力 4.02 × 10^24 FLOP评测于 2025年5月29日来源 DeepSeek ↗看逐题日志 ↗许可 CC BY 4.0
MATH Level 5数学
高难竞赛数学问题正确率。
默认档96.6%±
参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩
多次评分最佳 96.6%训练算力 4.02 × 10^24 FLOP评测于 2025年5月29日来源 DeepSeek ↗看逐题日志 ↗许可 CC BY 4.0
SimpleBench推理
以多次作答平均分衡量常识与推理能力。
默认档40.8%
参加这项评测的全部模型 中位 49.5% · 最高 81.9% · 共 102 个成绩
训练算力 4.02 × 10^24 FLOP评测于 2025年5月28日来源 DeepSeek ↗许可 CC BY 4.0
配上 Agent 能做到什么
这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。
Aider Polyglot编程
多语言代码编辑任务;结果包含 Aider 执行框架影响。
默认档71.4%
参加这项评测的全部模型 中位 53.8% · 最高 88.0% · 共 71 个成绩
训练算力 4.02 × 10^24 FLOP评测于 2025年6月6日来源 DeepSeek ↗许可 Apache License 2.0
DeepResearchBench任务执行
需要检索、综合与引用的深度研究任务;结果包含研究 Agent 与工具环境。
默认档35.1%
参加这项评测的全部模型 中位 47.9% · 最高 55.3% · 共 41 个成绩
训练算力 4.02 × 10^24 FLOP评测于 2025年5月28日来源 DeepSeek ↗许可 CC BY 4.0
METR Time Horizons任务执行
在 METR 任务分布中达到约 50% 成功率的任务时长(分钟);结果包含评测执行环境。
默认档31.2
参加这项评测的全部模型 中位 55.1 · 最高 1044.8 · 共 50 个成绩
训练算力 4.02 × 10^24 FLOP评测于 2025年5月28日来源 DeepSeek ↗许可 CC BY 4.0