选模型,先看清能力和官方价选模型,看能力和价格

955 个模型,其中 159 个有独立评测成绩。勾 2–4 个就能并排比。哪个模型更强、官方卖多少钱

我要用它做什么?可跳过

筛选
厂商
模型类型

有独立评测成绩的 159 个排在前面,剩下 796 个只有厂商官方信息,没测过就空着,不拿 0 分充数。 成绩来自第三方评测机构 Epoch AI。

评测列
955 个模型模型能力Agent / 工具
排序
多档位
  • GPT-6 Astra100%第一梯队
    • 官方价格(输入/输出)67.25199336.25995
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • Claude Fable 5.1100%第一梯队
    • 官方价格(输入/输出)67.25199336.25995
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)有停用计划
  • Claude Fable 599%第一梯队
    • 官方价格(输入/输出)67.25199336.25995
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)有停用计划
  • Claude Opus 599%第一梯队
    • 官方价格(输入/输出)33.625995168.129975
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)有停用计划
  • GPT-5.5 Pro98%第一梯队
    • 官方价格(输入/输出)201.755971,210.53582
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • GPT-5.6 Sol98%第一梯队
    • 官方价格(输入/输出)26.900796134.50398
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • GPT-5.6 Terra98%第一梯队
    • 官方价格(输入/输出)13.45039880.702388
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • GPT-5.597%第一梯队
    • 官方价格(输入/输出)33.625995201.75597
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • GPT-5.4 Pro97%第一梯队
    • 官方价格(输入/输出)201.755971,210.53582
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • Claude Opus 4.897%第一梯队
    • 官方价格(输入/输出)33.625995168.129975
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)有停用计划
  • Kimi K396%第一梯队
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • Gemini 3.7 Flash96%第一梯队
    • 官方价格(输入/输出)5.04389925.219496
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • GPT-5.495%第一梯队
    • 官方价格(输入/输出)16.812998100.877985
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • Qwen 3.8 Max95%第一梯队
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)1M
    • 状态(官方在售状态)可以用
  • GPT-5.3 Codex95%第一梯队
    • 官方价格(输入/输出)11.76909894.152786
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • Gemini 3.8 Flash94%第一梯队
    • 官方价格(输入/输出)5.04389925.219496
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • Grok 4.694%第一梯队
    • 官方价格(输入/输出)13.45039840.351194
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • Claude Opus 4.794%第一梯队
    • 官方价格(输入/输出)33.625995168.129975
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)有停用计划
  • GPT-5.6 Luna93%第一梯队
    • 官方价格(输入/输出)1.345048.070239
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • Claude Sonnet 593%第一梯队
    • 官方价格(输入/输出)13.45039867.25199
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)有停用计划
  • GPT-5.2 Pro92%第一梯队
    • 官方价格(输入/输出)141.2291791,129.833432
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • Claude Opus 4.691%第一梯队
    • 官方价格(输入/输出)33.625995168.129975
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)有停用计划
  • GLM-5.391%第一梯队
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)1.0M
    • 状态(官方在售状态)可以用
  • Gemini 3.5 Flash90%第一梯队
    • 官方价格(输入/输出)10.08779960.526791
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • Gemini 3.6 Flash89%第一梯队
    • 官方价格(输入/输出)5.04389925.219496
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • Grok 4.588%第一梯队
    • 官方价格(输入/输出)13.45039840.351194
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • Qwen3.7 Max88%第一梯队
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • GPT-5.288%第一梯队
    • 官方价格(输入/输出)11.76909894.152786
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • Claude Sonnet 4.687%第一梯队
    • 官方价格(输入/输出)20.175597100.877985
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)有停用计划
  • GLM-5.286%第一梯队
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • Kimi K2.685%
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • GPT-5 Pro84%
    • 官方价格(输入/输出)100.877985807.02388
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
    • 官方价格(输入/输出)33.625995168.129975
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)有停用计划
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • GPT-583%
    • 官方价格(输入/输出)8.40649967.25199
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • GLM-5.182%
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • GPT-5.182%
    • 官方价格(输入/输出)8.40649967.25199
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)1.0M
    • 状态(官方在售状态)可以用
  • Kimi K2.580%
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • o3-pro79%
    • 官方价格(输入/输出)134.50398538.01592
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • o378%
    • 官方价格(输入/输出)13.45039853.801592
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
    • 官方价格(输入/输出)20.175597100.877985
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)有停用计划
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
  • MiniMax-M376%
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)
    • 状态(官方在售状态)可以用
    • 官方价格(输入/输出)
    • 上下文(最大输入 Token)1.0M
    • 状态(官方在售状态)可以用
100%第一梯队67.25199/336.25995可以用
100%第一梯队67.25199/336.25995有停用计划
99%第一梯队67.25199/336.25995有停用计划
99%第一梯队33.625995/168.129975有停用计划92.9%
98%第一梯队201.75597/1,210.53582可以用
98%第一梯队26.900796/134.50398可以用
98%第一梯队13.450398/80.702388可以用
97%第一梯队33.625995/201.75597可以用
97%第一梯队201.75597/1,210.53582可以用
97%第一梯队33.625995/168.129975有停用计划
96%第一梯队可以用
96%第一梯队5.043899/25.219496可以用
95%第一梯队16.812998/100.877985可以用
95%第一梯队1M可以用
95%第一梯队11.769098/94.152786可以用
94%第一梯队5.043899/25.219496可以用
94%第一梯队13.450398/40.351194可以用
94%第一梯队33.625995/168.129975有停用计划
93%第一梯队1.34504/8.070239可以用
93%第一梯队13.450398/67.25199有停用计划
92%第一梯队141.229179/1,129.833432可以用
91%第一梯队33.625995/168.129975有停用计划
91%第一梯队1.0M可以用
90%第一梯队10.087799/60.526791可以用
89%第一梯队5.043899/25.219496可以用
88%第一梯队13.450398/40.351194可以用
88%第一梯队可以用90.9%55.8%
88%第一梯队11.769098/94.152786可以用
87%第一梯队20.175597/100.877985有停用计划
86%第一梯队可以用
85%可以用
85%可以用90.8%34.9%
84%100.877985/807.02388可以用
83%33.625995/168.129975有停用计划80.7%7.78%
83%可以用87.9%36.5%
83%8.406499/67.25199可以用
82%可以用89.9%34.0%
82%8.406499/67.25199可以用
81%1.0M可以用
80%可以用34.3%11.8%
79%134.50398/538.01592可以用
79%可以用87.9%
78%可以用85.9%
78%13.450398/53.801592可以用
77%20.175597/100.877985有停用计划73.7%23.7%3.75%
77%可以用4.86%
76%可以用85.9%
76%可以用90.9%
75%可以用
74%1.0M可以用

分数颜色越深,说明这项成绩在同批模型里排得越靠前,表头写了这批模型的中位分和最高分。同一个模型跑出多个成绩的,显示区间,不挑最高的那次充门面。

模型是什么、官方卖多少钱
型号、规格和官方价,来自模型中心整理的厂商公开资料。
有多强、能不能干活
Epoch AI, AI Benchmarking Hub (2026);CC BY 4.0每项评测的转载授权以原作者为准。
第三方实际卖多少钱
这页只看官方价。想知道各家中转站卖多少、真不真,请看通过模型找中转
我们不做这几件事
不自己出题给模型打分,不把不同评测的分数硬凑成一个总分,也不把带工具的成绩说成模型自己的本事。