模型详情

Grok 2 1212

Grok · grok-2-1212

Grok 2 1212 显著提升了准确性、指令遵循能力以及多语言支持,对于寻求高度可控、智能模型的开发者而言,它是一个强大且灵活的选择。

官方已停服,这里卖的可能不是原模型

Grok 2 1212 官方已停止服务。中转站还在用这个名字卖,实际给你的可能是别的模型。真要买,先小额试用,或先去验真确认是不是原模型。

官方已下线xAI 官方模型退役公告核对

模型介绍

Grok 2 1212 显著提升了准确性、指令遵循能力以及多语言支持,对于寻求高度可控、智能模型的开发者而言,它是一个强大且灵活的选择。

查看介绍来源

模型基础信息

厂商
Grok
怎么计费
按 Token 计费官方按什么单位收钱
现在还能用吗
官方已下线官方已停止提供,通常已经调不通了;页面上的成绩只反映它当时的表现。
这些资料是哪个地区的
全球按厂商全球公布的资料显示;国内没单独公布时,也用这一份。
它还叫这些名字(21 条)
GROK 2 1212GROK 2 1212(xai-api · international)GROK-2-1212GROK-2-1212(xai-api · international)GROK_2_1212GROK_2_1212(xai-api · international)Grok 2 1212Grok-2-1212Grok_2_1212grok 2 1212grok 2 1212(xai-api · international)grok-2-1212grok-2-1212(xai-api · international)grok_2_1212grok_2_1212(xai-api · international)xai/GROK 2 1212(xai-api · international)xai/GROK-2-1212(xai-api · international)xai/GROK_2_1212(xai-api · international)xai/grok 2 1212(xai-api · international)xai/grok-2-1212(xai-api · international)xai/grok_2_1212(xai-api · international)

不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。

官方价格

计价项适用范围官方价格
输入全球2 USD/ 1,000,000 token
输出全球10 USD/ 1,000,000 token

它有多强

成绩来自 Epoch AI, AI Benchmarking Hub (2026)
5 / 2020 项评测里,这个模型测过 5 项
模型自己的成绩
5
配上工具的成绩
0
换不同设置跑出的成绩
5

这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。

还有 15 项评测没测过这个模型
Aider PolyglotCyBenchDeepResearchBenchGDPvalMETR Time HorizonsOSWorldOSWorld 2SWE-bench VerifiedTerminal-BenchARC-AGI-2Epoch Capabilities IndexHumanity's Last ExamMirrorCodeSimpleQA VerifiedVideo-MME

可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。

这个模型还没有可比的综合成绩,下面是它的单项成绩。

模型自己的成绩

同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。

FrontierMath数学

由专业数学家设计的前沿数学问题。

默认档0.69%±

参加这项评测的全部模型 中位 13.5% · 最高 52.4% · 共 101 个成绩

多次评分最佳 0.69%训练算力 2.96 × 10^25 FLOP评测于 2025年3月7日来源 xAI看逐题日志 ↗许可 CC BY 4.0

GPQA Diamond推理

研究生级科学问答,衡量高难知识推理。

默认档53.8%±

参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩

多次评分最佳 53.8%训练算力 2.96 × 10^25 FLOP评测于 2025年1月27日来源 xAI看逐题日志 ↗许可 CC BY 4.0

LiveBench推理版本 LiveBench-2024-11-25

使用持续更新题目降低污染风险的综合能力评测。

默认档54.3

参加这项评测的全部模型 中位 52.4 · 最高 82.3 · 共 52 个成绩

训练算力 2.96 × 10^25 FLOP评测于 2024年12月12日来源 xAI许可 CC BY 4.0

MATH Level 5数学

高难竞赛数学问题正确率。

默认档63.5%±

参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩

多次评分最佳 63.5%训练算力 2.96 × 10^25 FLOP评测于 2025年2月18日来源 xAI看逐题日志 ↗许可 CC BY 4.0

SimpleBench推理

以多次作答平均分衡量常识与推理能力。

默认档22.7%

参加这项评测的全部模型 中位 49.5% · 最高 81.9% · 共 102 个成绩

训练算力 2.96 × 10^25 FLOP评测于 2024年12月12日来源 xAI许可 CC BY 4.0

配上 Agent 能做到什么

这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。

这个模型还没有出现在 SWE-bench、Terminal-Bench 一类的 Agent 评测里。

用户点评

暂无公开评价

可以写下第一条评价。

发布匿名点评

评分
5
上传图片/视频

用户问答

暂无公开问答

你可以提出第一个问题。

提出问题

价格怎么算、买了能不能用、接口好不好接,都可以问问用过的人

上传图片/视频

Grok 2 1212

Grok 2 1212 显著提升了准确性、指令遵循能力以及多语言支持,对于寻求高度可控、智能模型的开发者而言,它是一个强大且灵活的选择。

官方已下线xAI 官方模型退役公告核对

模型介绍

Grok 2 1212 显著提升了准确性、指令遵循能力以及多语言支持,对于寻求高度可控、智能模型的开发者而言,它是一个强大且灵活的选择。

查看介绍来源

模型基础信息

厂商
Grok
怎么计费
按 Token 计费官方按什么单位收钱
现在还能用吗
官方已下线官方已停止提供,通常已经调不通了;页面上的成绩只反映它当时的表现。
这些资料是哪个地区的
全球按厂商全球公布的资料显示;国内没单独公布时,也用这一份。
它还叫这些名字(21 条)
GROK 2 1212GROK 2 1212(xai-api · international)GROK-2-1212GROK-2-1212(xai-api · international)GROK_2_1212GROK_2_1212(xai-api · international)Grok 2 1212Grok-2-1212Grok_2_1212grok 2 1212grok 2 1212(xai-api · international)grok-2-1212grok-2-1212(xai-api · international)grok_2_1212grok_2_1212(xai-api · international)xai/GROK 2 1212(xai-api · international)xai/GROK-2-1212(xai-api · international)xai/GROK_2_1212(xai-api · international)xai/grok 2 1212(xai-api · international)xai/grok-2-1212(xai-api · international)xai/grok_2_1212(xai-api · international)

不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。

官方价格

计价项适用范围官方价格
输入全球2 USD/ 1,000,000 token
输出全球10 USD/ 1,000,000 token

它有多强

成绩来自 Epoch AI, AI Benchmarking Hub (2026)
5 / 2020 项评测里,这个模型测过 5 项
模型自己的成绩
5
配上工具的成绩
0
换不同设置跑出的成绩
5

这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。

还有 15 项评测没测过这个模型
Aider PolyglotCyBenchDeepResearchBenchGDPvalMETR Time HorizonsOSWorldOSWorld 2SWE-bench VerifiedTerminal-BenchARC-AGI-2Epoch Capabilities IndexHumanity's Last ExamMirrorCodeSimpleQA VerifiedVideo-MME

可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。

这个模型还没有可比的综合成绩,下面是它的单项成绩。

模型自己的成绩

同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。

FrontierMath数学

由专业数学家设计的前沿数学问题。

默认档0.69%±

参加这项评测的全部模型 中位 13.5% · 最高 52.4% · 共 101 个成绩

多次评分最佳 0.69%训练算力 2.96 × 10^25 FLOP评测于 2025年3月7日来源 xAI看逐题日志 ↗许可 CC BY 4.0

GPQA Diamond推理

研究生级科学问答,衡量高难知识推理。

默认档53.8%±

参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩

多次评分最佳 53.8%训练算力 2.96 × 10^25 FLOP评测于 2025年1月27日来源 xAI看逐题日志 ↗许可 CC BY 4.0

LiveBench推理版本 LiveBench-2024-11-25

使用持续更新题目降低污染风险的综合能力评测。

默认档54.3

参加这项评测的全部模型 中位 52.4 · 最高 82.3 · 共 52 个成绩

训练算力 2.96 × 10^25 FLOP评测于 2024年12月12日来源 xAI许可 CC BY 4.0

MATH Level 5数学

高难竞赛数学问题正确率。

默认档63.5%±

参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩

多次评分最佳 63.5%训练算力 2.96 × 10^25 FLOP评测于 2025年2月18日来源 xAI看逐题日志 ↗许可 CC BY 4.0

SimpleBench推理

以多次作答平均分衡量常识与推理能力。

默认档22.7%

参加这项评测的全部模型 中位 49.5% · 最高 81.9% · 共 102 个成绩

训练算力 2.96 × 10^25 FLOP评测于 2024年12月12日来源 xAI许可 CC BY 4.0

配上 Agent 能做到什么

这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。

这个模型还没有出现在 SWE-bench、Terminal-Bench 一类的 Agent 评测里。

中转服务商对比

官方已停服,这里卖的可能不是原模型

Grok 2 1212 官方已停止服务。中转站还在用这个名字卖,实际给你的可能是别的模型。真要买,先小额试用,或先去验真确认是不是原模型。 去验真

筛选
综合参考分
验真通过率
相对官方价
34 家中转服务商
排序
中转服务商参考分输入/M Tokens输出/M Tokens缓存读/M Tokens缓存创建/M Tokens相对官方价验真通过率 / 更新时间

最新验真报告

下面是别人对这个模型做过的检测,按时间从新到旧排。

暂无公开报告

验真报告公开后会展示在这里。

用户点评

Grok 2 1212综合评分--☆☆☆☆☆ 0 人点评
评分人数分布
★★★★★0
★★★★☆0
★★★☆☆0
★★☆☆☆0
★☆☆☆☆0
暂无公开点评

公开点评会展示在这里,登录后可以提交真实使用体验。

用户问答

暂无公开问答

你可以提出第一个问题。

提出问题

价格怎么算、买了能不能用、接口好不好接,都可以问问用过的人

上传图片/视频