模型介绍
DeepSeek V3 是 DeepSeek 推出的对话模型。它可接收文本,可生成文本,支持提示缓存、工具调用。
模型基础信息
- 厂商
- DeepSeek
- 模型类型
- 文本与多模态
- 能接收什么
- 文本可以发给它的内容类型
- 能产出什么
- 文本它能生成的内容类型
- 能调工具吗
- 可以能不能自动调用外部函数、查资料、执行动作
- 它会做什么
- 会聊天 · 支持缓存省钱 · 回答风格可调 · 会写字 · 会调工具
- 这些资料是哪个地区的
- 中国大陆厂商专门为中国大陆公布的资料。
它还叫这些名字(112 条)
DEEPSEEK V3DEEPSEEK V3(alibaba-model-studio-cn · cn_mainland)DEEPSEEK V3(azure-ai · international)DEEPSEEK V3(deepseek-api-cn · international)DEEPSEEK V3(digitalocean · international)DEEPSEEK V3(helicone · international)DEEPSEEK V3(qiniu-ai · international)DEEPSEEK-V3DEEPSEEK-V3(alibaba-model-studio-cn · cn_mainland)DEEPSEEK-V3(azure-ai · international)DEEPSEEK-V3(deepseek-api-cn · international)DEEPSEEK-V3(digitalocean · international)DEEPSEEK-V3(helicone · international)DEEPSEEK-V3(qiniu-ai · international)DEEPSEEKV3DEEPSEEKV3(alibaba-model-studio-cn · cn_mainland)DEEPSEEKV3(azure-ai · international)DEEPSEEKV3(deepseek-api-cn · international)DEEPSEEKV3(digitalocean · international)DEEPSEEKV3(helicone · international)DEEPSEEKV3(qiniu-ai · international)DEEPSEEK_V3DEEPSEEK_V3(alibaba-model-studio-cn · cn_mainland)DEEPSEEK_V3(azure-ai · international)DEEPSEEK_V3(deepseek-api-cn · international)DEEPSEEK_V3(digitalocean · international)DEEPSEEK_V3(helicone · international)DEEPSEEK_V3(qiniu-ai · international)DeepSeek V3DeepSeek V3(alibaba-model-studio-cn · cn_mainland)DeepSeek V3(azure-ai · international)DeepSeek V3(deepseek-api-cn · international)DeepSeek V3(digitalocean · international)DeepSeek V3(helicone · international)DeepSeek V3(qiniu-ai · international)DeepSeek v3DeepSeek v3(alibaba-model-studio-cn · cn_mainland)DeepSeek v3(azure-ai · international)DeepSeek v3(deepseek-api-cn · international)DeepSeek v3(digitalocean · international)DeepSeek v3(helicone · international)DeepSeek v3(qiniu-ai · international)DeepSeek-V3DeepSeek-V3(alibaba-model-studio-cn · cn_mainland)DeepSeek-V3(azure-ai · international)DeepSeek-V3(deepseek-api-cn · international)DeepSeek-V3(digitalocean · international)DeepSeek-V3(helicone · international)DeepSeek-V3(qiniu-ai · international)DeepSeek-v3DeepSeek-v3(alibaba-model-studio-cn · cn_mainland)DeepSeek-v3(azure-ai · international)DeepSeek-v3(deepseek-api-cn · international)DeepSeek-v3(digitalocean · international)DeepSeek-v3(helicone · international)DeepSeek-v3(qiniu-ai · international)DeepSeekV3DeepSeekV3(alibaba-model-studio-cn · cn_mainland)DeepSeekV3(azure-ai · international)DeepSeekV3(deepseek-api-cn · international)DeepSeekV3(digitalocean · international)DeepSeekV3(helicone · international)DeepSeekV3(qiniu-ai · international)DeepSeek_V3DeepSeek_V3(alibaba-model-studio-cn · cn_mainland)DeepSeek_V3(azure-ai · international)DeepSeek_V3(deepseek-api-cn · international)DeepSeek_V3(digitalocean · international)DeepSeek_V3(helicone · international)DeepSeek_V3(qiniu-ai · international)DeepSeek_v3DeepSeek_v3(alibaba-model-studio-cn · cn_mainland)DeepSeek_v3(azure-ai · international)DeepSeek_v3(deepseek-api-cn · international)DeepSeek_v3(digitalocean · international)DeepSeek_v3(helicone · international)DeepSeek_v3(qiniu-ai · international)DeepSeekv3DeepSeekv3(alibaba-model-studio-cn · cn_mainland)DeepSeekv3(azure-ai · international)DeepSeekv3(deepseek-api-cn · international)DeepSeekv3(digitalocean · international)DeepSeekv3(helicone · international)DeepSeekv3(qiniu-ai · international)deepseek v3deepseek v3(alibaba-model-studio-cn · cn_mainland)deepseek v3(azure-ai · international)deepseek v3(deepseek-api-cn · international)deepseek v3(digitalocean · international)deepseek v3(helicone · international)deepseek v3(qiniu-ai · international)deepseek-v3deepseek-v3(alibaba-model-studio-cn · cn_mainland)deepseek-v3(azure-ai · international)deepseek-v3(deepseek-api-cn · international)deepseek-v3(digitalocean · international)deepseek-v3(helicone · international)deepseek-v3(qiniu-ai · international)deepseek_v3deepseek_v3(alibaba-model-studio-cn · cn_mainland)deepseek_v3(azure-ai · international)deepseek_v3(deepseek-api-cn · international)deepseek_v3(digitalocean · international)deepseek_v3(helicone · international)deepseek_v3(qiniu-ai · international)deepseekv3deepseekv3(alibaba-model-studio-cn · cn_mainland)deepseekv3(azure-ai · international)deepseekv3(deepseek-api-cn · international)deepseekv3(digitalocean · international)deepseekv3(helicone · international)deepseekv3(qiniu-ai · international)不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
官方价格
| 计价项 | 适用范围 | 官方价格 |
|---|
| 缓存读取 | 中国大陆 | 0.4 CNY/ 1,000,000 token |
| 输入 | 中国大陆 | 2 CNY/ 1,000,000 token |
| 输出 | 中国大陆 | 8 CNY/ 1,000,000 token |
| 缓存读取 | 全球 | 0.07 USD/ 1,000,000 token |
| 缓存写入 | 全球 | 0 USD/ 1,000,000 token |
| 输入 | 全球 | 0.27 USD/ 1,000,000 token |
| 输出 | 全球 | 1.1 USD/ 1,000,000 token |
它有多强
成绩来自 Epoch AI, AI Benchmarking Hub (2026)8 / 20 项20 项评测里,这个模型测过 8 项
- 模型自己的成绩
- 6 项
- 配上工具的成绩
- 2 项
- 换不同设置跑出的成绩
- 8 次
这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。
还有 12 项评测没测过这个模型
CyBenchDeepResearchBenchGDPvalOSWorldOSWorld 2SWE-bench VerifiedTerminal-BenchARC-AGI-2Humanity's Last ExamMirrorCodeSimpleQA VerifiedVideo-MME可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。
中等综合能力档位
入门中等强第一梯队
47%在同批模型里的位置
这个档位是怎么来的
按第三方评测机构 Epoch 的公开成绩,看它在同批模型里排在什么位置,不是我们自己打的分。新模型加进来时,这个位置会小幅变动。
模型自己的成绩
同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。
FrontierMath数学
由专业数学家设计的前沿数学问题。
默认档1.72%±
参加这项评测的全部模型 中位 13.5% · 最高 52.4% · 共 101 个成绩
多次评分最佳 1.72%训练算力 3.30 × 10^24 FLOP评测于 2025年3月8日来源 DeepSeek ↗看逐题日志 ↗许可 CC BY 4.0
GPQA Diamond推理
研究生级科学问答,衡量高难知识推理。
默认档56.5%±
参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩
多次评分最佳 56.5%训练算力 3.30 × 10^24 FLOP评测于 2025年1月27日来源 DeepSeek ↗看逐题日志 ↗许可 CC BY 4.0
LiveBench推理版本 LiveBench-2024-11-25
使用持续更新题目降低污染风险的综合能力评测。
默认档60.5
参加这项评测的全部模型 中位 52.4 · 最高 82.3 · 共 52 个成绩
训练算力 3.30 × 10^24 FLOP评测于 2024年12月26日来源 DeepSeek ↗许可 CC BY 4.0
MATH Level 5数学
高难竞赛数学问题正确率。
默认档64.9%±
参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩
多次评分最佳 64.9%训练算力 3.30 × 10^24 FLOP评测于 2025年1月27日来源 DeepSeek ↗看逐题日志 ↗许可 CC BY 4.0
SimpleBench推理
以多次作答平均分衡量常识与推理能力。
默认档18.9%
参加这项评测的全部模型 中位 49.5% · 最高 81.9% · 共 102 个成绩
训练算力 3.30 × 10^24 FLOP评测于 2024年12月26日来源 DeepSeek ↗许可 CC BY 4.0
配上 Agent 能做到什么
这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。
Aider Polyglot编程
多语言代码编辑任务;结果包含 Aider 执行框架影响。
默认档48.4%
参加这项评测的全部模型 中位 53.8% · 最高 88.0% · 共 71 个成绩
训练算力 3.30 × 10^24 FLOP评测于 2024年12月26日来源 DeepSeek ↗许可 Apache License 2.0
METR Time Horizons任务执行
在 METR 任务分布中达到约 50% 成功率的任务时长(分钟);结果包含评测执行环境。
默认档18.5
参加这项评测的全部模型 中位 55.1 · 最高 1044.8 · 共 50 个成绩
训练算力 3.30 × 10^24 FLOP评测于 2024年12月26日来源 DeepSeek ↗许可 CC BY 4.0