模型介绍
DeepSeek-R1-Distill-Qwen-7B 是一个 70 亿参数的稠密语言模型,它从 DeepSeek-R1 蒸馏而来,利用了由 DeepSeek 更大模型生成的经强化学习增强的推理数据。
展开完整介绍
DeepSeek-R1-Distill-Qwen-7B 是一个 70 亿参数的稠密语言模型,它从 DeepSeek-R1 蒸馏而来,利用了由 DeepSeek 更大模型生成的经强化学习增强的推理数据。该蒸馏过程将先进的推理、数学和代码能力转移到了基于 Qwen2.5-Math-7B 的更小、更高效的模型架构中。该模型在数学基准测试(MATH-500 上的 pass@1 为 92.8%)、编程任务(Codeforces 评分为 1189)和通用推理(GPQA Diamond 上的 pass@1 为 49.1%)中展现出强劲的表现,在保持更低推理成本的同时,取得了与更大模型相比具有竞争力的准确率。
查看介绍来源模型基础信息
- 厂商
- DeepSeek
- 模型类型
- 文本与多模态
- 能接收什么
- 文本可以发给它的内容类型
- 能产出什么
- 文本它能生成的内容类型
- 能调工具吗
- 可以能不能自动调用外部函数、查资料、执行动作
- 它会做什么
- 擅长推理 · 回答风格可调 · 会写字 · 会调工具
- 怎么计费
- 按 Token 计费官方按什么单位收钱
- 这些资料是哪个地区的
- 中国大陆厂商专门为中国大陆公布的资料。
它还叫这些名字(59 条)
DEEPSEEK R1 DISTILL QWEN 7BDEEPSEEK R1 DISTILL QWEN 7B(alibaba-model-studio-cn · cn_mainland)DEEPSEEK R1 DISTILL QWEN 7B(deepseek-api-cn · global)DEEPSEEK-R1-DISTILL-QWEN-7BDEEPSEEK-R1-DISTILL-QWEN-7B(alibaba-model-studio-cn · cn_mainland)DEEPSEEK-R1-DISTILL-QWEN-7B(deepseek-api-cn · global)DEEPSEEK.R1.DISTILL.QWEN.7B(deepseek-api-cn · global)DEEPSEEKR1DISTILLQWEN7BDEEPSEEKR1DISTILLQWEN7B(alibaba-model-studio-cn · cn_mainland)DEEPSEEKR1DISTILLQWEN7B(deepseek-api-cn · global)DEEPSEEK_R1_DISTILL_QWEN_7BDEEPSEEK_R1_DISTILL_QWEN_7B(alibaba-model-studio-cn · cn_mainland)DEEPSEEK_R1_DISTILL_QWEN_7B(deepseek-api-cn · global)DeepSeek R1 DISTILL QWEN 7BDeepSeek R1 DISTILL QWEN 7B(alibaba-model-studio-cn · cn_mainland)DeepSeek R1 DISTILL QWEN 7B(deepseek-api-cn · global)DeepSeek R1 Distill Qwen 7BDeepSeek R1 Distill Qwen 7B(deepseek-api-cn · global)DeepSeek r1 distill qwen 7bDeepSeek r1 distill qwen 7b(alibaba-model-studio-cn · cn_mainland)DeepSeek r1 distill qwen 7b(deepseek-api-cn · global)DeepSeek-R1-DISTILL-QWEN-7BDeepSeek-R1-DISTILL-QWEN-7B(alibaba-model-studio-cn · cn_mainland)DeepSeek-R1-DISTILL-QWEN-7B(deepseek-api-cn · global)DeepSeek-R1-Distill-Qwen-7BDeepSeek-R1-Distill-Qwen-7B(deepseek-api-cn · global)DeepSeek-r1-distill-qwen-7bDeepSeek-r1-distill-qwen-7b(alibaba-model-studio-cn · cn_mainland)DeepSeek-r1-distill-qwen-7b(deepseek-api-cn · global)DeepSeek.R1.Distill.Qwen.7B(deepseek-api-cn · global)DeepSeekR1DISTILLQWEN7BDeepSeekR1DISTILLQWEN7B(alibaba-model-studio-cn · cn_mainland)DeepSeekR1DISTILLQWEN7B(deepseek-api-cn · global)DeepSeekR1DistillQwen7BDeepSeekR1DistillQwen7B(deepseek-api-cn · global)DeepSeek_R1_DISTILL_QWEN_7BDeepSeek_R1_DISTILL_QWEN_7B(alibaba-model-studio-cn · cn_mainland)DeepSeek_R1_DISTILL_QWEN_7B(deepseek-api-cn · global)DeepSeek_R1_Distill_Qwen_7BDeepSeek_R1_Distill_Qwen_7B(deepseek-api-cn · global)DeepSeek_r1_distill_qwen_7bDeepSeek_r1_distill_qwen_7b(alibaba-model-studio-cn · cn_mainland)DeepSeek_r1_distill_qwen_7b(deepseek-api-cn · global)DeepSeekr1distillqwen7bDeepSeekr1distillqwen7b(alibaba-model-studio-cn · cn_mainland)DeepSeekr1distillqwen7b(deepseek-api-cn · global)deepseek r1 distill qwen 7bdeepseek r1 distill qwen 7b(alibaba-model-studio-cn · cn_mainland)deepseek r1 distill qwen 7b(deepseek-api-cn · global)deepseek-r1-distill-qwen-7bdeepseek-r1-distill-qwen-7b(alibaba-model-studio-cn · cn_mainland)deepseek-r1-distill-qwen-7b(deepseek-api-cn · global)deepseek.r1.distill.qwen.7b(deepseek-api-cn · global)deepseek_r1_distill_qwen_7bdeepseek_r1_distill_qwen_7b(alibaba-model-studio-cn · cn_mainland)deepseek_r1_distill_qwen_7b(deepseek-api-cn · global)deepseekr1distillqwen7bdeepseekr1distillqwen7b(alibaba-model-studio-cn · cn_mainland)deepseekr1distillqwen7b(deepseek-api-cn · global)不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
官方价格
| 计价项 | 适用范围 | 官方价格 |
|---|
| 输入 | 中国大陆 | 0.5 CNY/ 1,000,000 token |
| 输出 | 中国大陆 | 1 CNY/ 1,000,000 token |
它有多强
成绩来自 Epoch AI, AI Benchmarking Hub (2026)0 / 20 项20 项评测里,这个模型测过 0 项
- 模型自己的成绩
- 0 项
- 配上工具的成绩
- 0 项
- 换不同设置跑出的成绩
- 0 次
这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。
还有 20 项评测没测过这个模型
Aider PolyglotCyBenchDeepResearchBenchGDPvalMETR Time HorizonsOSWorldOSWorld 2SWE-bench VerifiedTerminal-BenchARC-AGI-2Epoch Capabilities IndexFrontierMathGPQA DiamondHumanity's Last ExamLiveBenchMATH Level 5MirrorCodeSimpleBenchSimpleQA VerifiedVideo-MME可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。
这个模型还没有可比的综合成绩,下面是它的单项成绩。
模型自己的成绩
同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。
这个模型还没有可公开的单项成绩。
配上 Agent 能做到什么
这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。
这个模型还没有出现在 SWE-bench、Terminal-Bench 一类的 Agent 评测里。