DeepSeek R1 Distill Qwen 14B
DeepSeek · deepseek-r1-distill-qwen-14b
DeepSeek R1 Distill Qwen 14B 是一个基于 Qwen 2.5 14B 的蒸馏大语言模型,使用了来自 DeepSeek R1 的输出。它在多项基准测试中超越了 OpenAI 的 o1-mini,在稠密模型中取得了新的前沿(state-of-the-art)表现。
DeepSeek · deepseek-r1-distill-qwen-14b
DeepSeek R1 Distill Qwen 14B 是一个基于 Qwen 2.5 14B 的蒸馏大语言模型,使用了来自 DeepSeek R1 的输出。它在多项基准测试中超越了 OpenAI 的 o1-mini,在稠密模型中取得了新的前沿(state-of-the-art)表现。
DeepSeek R1 Distill Qwen 14B 是一个基于 Qwen 2.5 14B 的蒸馏大语言模型,使用了来自 DeepSeek R1 的输出。
DeepSeek R1 Distill Qwen 14B 是一个基于 Qwen 2.5 14B 的蒸馏大语言模型,使用了来自 DeepSeek R1 的输出。它在多项基准测试中超越了 OpenAI 的 o1-mini,在稠密模型中取得了新的前沿(state-of-the-art)表现。
不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
| 计价项 | 适用范围 | 官方价格 |
|---|---|---|
| 输入 | 中国大陆 | 1 CNY/ 1,000,000 token |
| 输出 | 中国大陆 | 3 CNY/ 1,000,000 token |
这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。
可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。
同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。
研究生级科学问答,衡量高难知识推理。
参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩
高难竞赛数学问题正确率。
参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩
这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。
这个模型还没有出现在 SWE-bench、Terminal-Bench 一类的 Agent 评测里。
Be the first to leave a review.
Be the first to ask a question.
DeepSeek R1 Distill Qwen 14B 是一个基于 Qwen 2.5 14B 的蒸馏大语言模型,使用了来自 DeepSeek R1 的输出。它在多项基准测试中超越了 OpenAI 的 o1-mini,在稠密模型中取得了新的前沿(state-of-the-art)表现。
DeepSeek R1 Distill Qwen 14B 是一个基于 Qwen 2.5 14B 的蒸馏大语言模型,使用了来自 DeepSeek R1 的输出。
DeepSeek R1 Distill Qwen 14B 是一个基于 Qwen 2.5 14B 的蒸馏大语言模型,使用了来自 DeepSeek R1 的输出。它在多项基准测试中超越了 OpenAI 的 o1-mini,在稠密模型中取得了新的前沿(state-of-the-art)表现。
不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
| 计价项 | 适用范围 | 官方价格 |
|---|---|---|
| 输入 | 中国大陆 | 1 CNY/ 1,000,000 token |
| 输出 | 中国大陆 | 3 CNY/ 1,000,000 token |
这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。
可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。
同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。
研究生级科学问答,衡量高难知识推理。
参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩
高难竞赛数学问题正确率。
参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩
这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。
这个模型还没有出现在 SWE-bench、Terminal-Bench 一类的 Agent 评测里。
下面是别人对这个模型做过的检测,按时间从新到旧排。
Verification reports show up here once they are public.
Public reviews will appear here. Sign in to share real usage experience.
Be the first to ask a question.