官方已下线(2026年6月15日 起)。Anthropic 官方模型目录中仍可识别的旧版本,保留经营状态但不作为新增优先模型
模型介绍
用于深度推理、编程和长期智能体的旗舰 Claude 模型
查看介绍来源模型基础信息
- 厂商
- Claude
- 模型类型
- 文本与多模态
- 能接收什么
- 图像 · PDF 文档 · 文本可以发给它的内容类型
- 能产出什么
- 文本它能生成的内容类型
- 能看图吗
- 可以
- 能调工具吗
- 可以能不能自动调用外部函数、查资料、执行动作
- 它会做什么
- 能读上传的文件 · 会聊天 · 支持缓存省钱 · 擅长推理 · 支持结构化输出 · 回答风格可调 · 会写字 · 会调工具 · 会看图
- 怎么计费
- 按 Token 计费官方按什么单位收钱
- 现在还能用吗
- 官方已下线 · 2026年6月15日 起 · 状态来源官方已停止提供,通常已经调不通了;页面上的成绩只反映它当时的表现。
- 这些资料是哪个地区的
- 全球按厂商全球公布的资料显示;国内没单独公布时,也用这一份。
它还叫这些名字(68 条)
CLAUDE OPUS 4CLAUDE OPUS 4 20250514CLAUDE OPUS 4 20250514(abacus · international)CLAUDE OPUS 4 20250514(anthropic-api · international)CLAUDE OPUS 4 20250514(jiekou · international)CLAUDE-OPUS-4CLAUDE-OPUS-4-20250514CLAUDE-OPUS-4-20250514(abacus · international)CLAUDE-OPUS-4-20250514(anthropic-api · international)CLAUDE-OPUS-4-20250514(jiekou · international)CLAUDEOPUS4CLAUDE_OPUS_4CLAUDE_OPUS_4_20250514CLAUDE_OPUS_4_20250514(abacus · international)CLAUDE_OPUS_4_20250514(anthropic-api · international)CLAUDE_OPUS_4_20250514(jiekou · international)Claude OPUS 4Claude OPUS 4 20250514Claude OPUS 4 20250514(abacus · international)Claude OPUS 4 20250514(anthropic-api · international)Claude OPUS 4 20250514(jiekou · international)Claude Opus 4Claude opus 4Claude opus 4 20250514Claude opus 4 20250514(abacus · international)Claude opus 4 20250514(anthropic-api · international)Claude opus 4 20250514(jiekou · international)Claude-OPUS-4Claude-OPUS-4-20250514Claude-OPUS-4-20250514(abacus · international)Claude-OPUS-4-20250514(anthropic-api · international)Claude-OPUS-4-20250514(jiekou · international)Claude-Opus-4Claude-opus-4Claude-opus-4-20250514Claude-opus-4-20250514(abacus · international)Claude-opus-4-20250514(anthropic-api · international)Claude-opus-4-20250514(jiekou · international)ClaudeOPUS4ClaudeOpus4Claude_OPUS_4Claude_OPUS_4_20250514Claude_OPUS_4_20250514(abacus · international)Claude_OPUS_4_20250514(anthropic-api · international)Claude_OPUS_4_20250514(jiekou · international)Claude_Opus_4Claude_opus_4Claude_opus_4_20250514Claude_opus_4_20250514(abacus · international)Claude_opus_4_20250514(anthropic-api · international)Claude_opus_4_20250514(jiekou · international)Claudeopus4claude opus 4claude opus 4 20250514claude opus 4 20250514(abacus · international)claude opus 4 20250514(anthropic-api · international)claude opus 4 20250514(jiekou · international)claude-opus-4claude-opus-4-20250514claude-opus-4-20250514(abacus · international)claude-opus-4-20250514(anthropic-api · international)claude-opus-4-20250514(jiekou · international)claude_opus_4claude_opus_4_20250514claude_opus_4_20250514(abacus · international)claude_opus_4_20250514(anthropic-api · international)claude_opus_4_20250514(jiekou · international)claudeopus4不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
官方价格
| 计价项 | 适用范围 | 官方价格 |
|---|
| 缓存读取 | 全球 | 1.5 USD/ 1,000,000 token |
| 缓存写入 | 全球 | 18.75 USD/ 1,000,000 token |
| 输入 | 全球 | 15 USD/ 1,000,000 token |
| 输出 | 全球 | 75 USD/ 1,000,000 token |
它有多强
成绩来自 Epoch AI, AI Benchmarking Hub (2026)8 / 20 项20 项评测里,这个模型测过 8 项
- 模型自己的成绩
- 5 项
- 配上工具的成绩
- 3 项
- 换不同设置跑出的成绩
- 8 次
这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。
还有 12 项评测没测过这个模型
DeepResearchBenchGDPvalMETR Time HorizonsOSWorldOSWorld 2Terminal-BenchHumanity's Last ExamLiveBenchMirrorCodeSimpleBenchSimpleQA VerifiedVideo-MME可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。
强综合能力档位
入门中等强第一梯队
67%在同批模型里的位置
这个档位是怎么来的
按第三方评测机构 Epoch 的公开成绩,看它在同批模型里排在什么位置,不是我们自己打的分。新模型加进来时,这个位置会小幅变动。
模型自己的成绩
同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。
ARC-AGI-2推理
新颖抽象规则归纳与泛化能力。
默认档1.27%
参加这项评测的全部模型 中位 9.86% · 最高 95.0% · 共 203 个成绩
每题成本 0.6388 评测于 2025年5月22日来源 Anthropic ↗许可 CC BY 4.0
FrontierMath数学
由专业数学家设计的前沿数学问题。
默认档4.48%±
参加这项评测的全部模型 中位 13.5% · 最高 52.4% · 共 101 个成绩
多次评分最佳 4.48%评测于 2025年7月4日来源 Anthropic ↗看逐题日志 ↗许可 CC BY 4.0
GPQA Diamond推理
研究生级科学问答,衡量高难知识推理。
默认档69.2%±
参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩
多次评分最佳 69.2%评测于 2025年5月23日来源 Anthropic ↗看逐题日志 ↗许可 CC BY 4.0
MATH Level 5数学
高难竞赛数学问题正确率。
默认档85.0%±
参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩
多次评分最佳 85.0%评测于 2025年5月23日来源 Anthropic ↗看逐题日志 ↗许可 CC BY 4.0
配上 Agent 能做到什么
这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。
Aider Polyglot编程
多语言代码编辑任务;结果包含 Aider 执行框架影响。
默认档70.7%
参加这项评测的全部模型 中位 53.8% · 最高 88.0% · 共 71 个成绩
评测于 2025年5月25日来源 Anthropic ↗许可 Apache License 2.0
CyBench任务执行
在网络安全任务中无分步提示完成的比例;结果包含任务环境与执行流程。
默认档38.0%
参加这项评测的全部模型 中位 21.3% · 最高 93.0% · 共 22 个成绩
评测于 2025年5月22日来源 Anthropic ↗许可 CC BY 4.0
SWE-bench Verified编程
在真实 GitHub 问题上修复代码;结果依赖 Agent 与工具链。
默认档70.7%±
参加这项评测的全部模型 中位 73.8% · 最高 83.5% · 共 33 个成绩
多次评分最佳 70.7%评测于 2026年2月6日来源 Anthropic ↗看逐题日志 ↗许可 CC BY 4.0