官方已下线。xAI 官方模型退役公告核对
模型介绍
Grok 2 1212 显著提升了准确性、指令遵循能力以及多语言支持,对于寻求高度可控、智能模型的开发者而言,它是一个强大且灵活的选择。
查看介绍来源模型基础信息
- 厂商
- Grok
- 怎么计费
- 按 Token 计费官方按什么单位收钱
- 现在还能用吗
- 官方已下线官方已停止提供,通常已经调不通了;页面上的成绩只反映它当时的表现。
- 这些资料是哪个地区的
- 全球按厂商全球公布的资料显示;国内没单独公布时,也用这一份。
它还叫这些名字(21 条)
GROK 2 1212GROK 2 1212(xai-api · international)GROK-2-1212GROK-2-1212(xai-api · international)GROK_2_1212GROK_2_1212(xai-api · international)Grok 2 1212Grok-2-1212Grok_2_1212grok 2 1212grok 2 1212(xai-api · international)grok-2-1212grok-2-1212(xai-api · international)grok_2_1212grok_2_1212(xai-api · international)xai/GROK 2 1212(xai-api · international)xai/GROK-2-1212(xai-api · international)xai/GROK_2_1212(xai-api · international)xai/grok 2 1212(xai-api · international)xai/grok-2-1212(xai-api · international)xai/grok_2_1212(xai-api · international)不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
官方价格
| 计价项 | 适用范围 | 官方价格 |
|---|
| 输入 | 全球 | 2 USD/ 1,000,000 token |
| 输出 | 全球 | 10 USD/ 1,000,000 token |
它有多强
成绩来自 Epoch AI, AI Benchmarking Hub (2026)5 / 20 项20 项评测里,这个模型测过 5 项
- 模型自己的成绩
- 5 项
- 配上工具的成绩
- 0 项
- 换不同设置跑出的成绩
- 5 次
这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。
还有 15 项评测没测过这个模型
Aider PolyglotCyBenchDeepResearchBenchGDPvalMETR Time HorizonsOSWorldOSWorld 2SWE-bench VerifiedTerminal-BenchARC-AGI-2Epoch Capabilities IndexHumanity's Last ExamMirrorCodeSimpleQA VerifiedVideo-MME可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。
这个模型还没有可比的综合成绩,下面是它的单项成绩。
模型自己的成绩
同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。
FrontierMath数学
由专业数学家设计的前沿数学问题。
默认档0.69%±
参加这项评测的全部模型 中位 13.5% · 最高 52.4% · 共 101 个成绩
多次评分最佳 0.69%训练算力 2.96 × 10^25 FLOP评测于 2025年3月7日来源 xAI ↗看逐题日志 ↗许可 CC BY 4.0
GPQA Diamond推理
研究生级科学问答,衡量高难知识推理。
默认档53.8%±
参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩
多次评分最佳 53.8%训练算力 2.96 × 10^25 FLOP评测于 2025年1月27日来源 xAI ↗看逐题日志 ↗许可 CC BY 4.0
LiveBench推理版本 LiveBench-2024-11-25
使用持续更新题目降低污染风险的综合能力评测。
默认档54.3
参加这项评测的全部模型 中位 52.4 · 最高 82.3 · 共 52 个成绩
训练算力 2.96 × 10^25 FLOP评测于 2024年12月12日来源 xAI ↗许可 CC BY 4.0
MATH Level 5数学
高难竞赛数学问题正确率。
默认档63.5%±
参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩
多次评分最佳 63.5%训练算力 2.96 × 10^25 FLOP评测于 2025年2月18日来源 xAI ↗看逐题日志 ↗许可 CC BY 4.0
SimpleBench推理
以多次作答平均分衡量常识与推理能力。
默认档22.7%
参加这项评测的全部模型 中位 49.5% · 最高 81.9% · 共 102 个成绩
训练算力 2.96 × 10^25 FLOP评测于 2024年12月12日来源 xAI ↗许可 CC BY 4.0
配上 Agent 能做到什么
这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。
这个模型还没有出现在 SWE-bench、Terminal-Bench 一类的 Agent 评测里。