Claude Sonnet 4
Claude · claude-sonnet-4-20250514
适用于编程、分析、智能体工作流和成本控制的均衡型 Claude 模型
Claude Sonnet 4 官方已于 2026年6月15日 停止服务。中转站还在用这个名字卖,实际给你的可能是别的模型。真要买,先小额试用,或先去验真确认是不是原模型。
适用于编程、分析、智能体工作流和成本控制的均衡型 Claude 模型
折扣与价格评分按全球的官方价计算
| 计价项 | 适用范围 | 官方价格 |
|---|---|---|
| 输入 | 全球 | 20.14 CNY/ 1,000,000 token |
| 输出 | 全球 | 100.72 CNY/ 1,000,000 token |
不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
这个模型还没有综合能力指数,排不出名次,下面是它的单项成绩。
科学难题、数学和没见过的新题,看它想得清不清楚。
从没见过的图形规律题,靠现场推理而不是背题。看它遇到新问题会不会举一反三。
研究生水平的物理、化学、生物难题。拿它做研究、分析复杂问题时看这项。
普通人一眼能答对、模型却容易掉坑的常识题。看它日常对话靠不靠谱。
答得对不对、会不会编造,查资料和写正式内容时最要紧。
上百个学科专家出的最难考题。看它知识面有多深、多广。
配上工具自己查资料、做长任务,适合交给它一整件事。标了「配工具」的成绩是模型加上评测方的工具和运行环境跑出来的,换一套工具结果会变,不算进上面的名次。
让模型自己上网查资料、综合整理并给出处。拿它做调研报告时看这项。
模型能独立做完多长时间的任务(按人类专家要花的分钟数算)。让它长时间自己干活时看这项。
这些评测停止更新、有成绩的模型太少或者和选购关系不大,成绩仅供参考,不影响上面的名次和用途筛选。
多语言代码编辑任务;结果包含 Aider 执行框架影响。
不再排行的原因:评测方已经很久没测新模型,排名反映不了现在的模型。
在网络安全任务中无分步提示完成的比例;结果包含任务环境与执行流程。
不再排行的原因:测的是网络攻防能力,和挑选日常使用的模型关系不大。
在真实电脑环境中完成跨应用任务;成绩取决于模型、Agent 和工具环境。
不再排行的原因:有成绩的在售模型太少,排不成榜。
Epoch AI 把几十项前沿评测合成的一个能力指数,用来看模型整体有多强。
不再排行的原因:综合能力已改按 Artificial Analysis 智能指数排名(覆盖的在售模型多一倍);Epoch 综合指数留作第二来源参考。
竞赛数学里最难一档题目的正确率。
不再排行的原因:主流模型几乎都能做满分,已经分不出高低;评测方也已停止测新模型。
Claude Sonnet 4 官方已于 2026年6月15日 停止服务。中转站还在用这个名字卖,实际给你的可能是别的模型。真要买,先小额试用,或先去验真确认是不是原模型。 去验真
还没有人点评。用过的话,写下第一条真实体验,帮后来的人少踩坑。