模型详情

gpt-4-1106-preview

OpenAI · gpt-4-1106-preview

gpt-4-1106-preview 是 ChatGPT 推出的对话模型。它支持提示缓存、工具调用。

模型介绍

gpt-4-1106-preview 是 ChatGPT 推出的对话模型。它支持提示缓存、工具调用。

模型基础信息

厂商
ChatGPT
模型类型
文本与多模态
能调工具吗
可以能不能自动调用外部函数、查资料、执行动作
它会做什么
会聊天 · 支持缓存省钱 · 可以设定角色 · 会调工具
怎么计费
按 Token 计费官方按什么单位收钱
现在还能用吗
有停用计划 · 状态来源
这些资料是哪个地区的
全球按厂商全球公布的资料显示;国内没单独公布时,也用这一份。
它还叫这些名字(18 条)
GPT 4 1106 PREVIEWGPT 4 1106 PREVIEW(azure · international)GPT 4 1106 PREVIEW(openai-api · international)GPT-4-1106-PREVIEWGPT-4-1106-PREVIEW(azure · international)GPT-4-1106-PREVIEW(openai-api · international)GPT_4_1106_PREVIEWGPT_4_1106_PREVIEW(azure · international)GPT_4_1106_PREVIEW(openai-api · international)gpt 4 1106 previewgpt 4 1106 preview(azure · international)gpt 4 1106 preview(openai-api · international)gpt-4-1106-previewgpt-4-1106-preview(azure · international)gpt-4-1106-preview(openai-api · international)gpt_4_1106_previewgpt_4_1106_preview(azure · international)gpt_4_1106_preview(openai-api · international)

不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。

官方价格

计价项适用范围官方价格
输入全球10 USD/ 1,000,000 token
输出全球30 USD/ 1,000,000 token

它有多强

成绩来自 Epoch AI, AI Benchmarking Hub (2026)
3 / 2020 项评测里,这个模型测过 3 项
模型自己的成绩
2
配上工具的成绩
1
换不同设置跑出的成绩
3

这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。

还有 17 项评测没测过这个模型
Aider PolyglotCyBenchDeepResearchBenchGDPvalOSWorldOSWorld 2SWE-bench VerifiedTerminal-BenchARC-AGI-2Epoch Capabilities IndexFrontierMathHumanity's Last ExamLiveBenchMirrorCodeSimpleBenchSimpleQA VerifiedVideo-MME

可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。

这个模型还没有可比的综合成绩,下面是它的单项成绩。

模型自己的成绩

同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。

GPQA Diamond推理

研究生级科学问答,衡量高难知识推理。

默认档42.4%±

参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩

多次评分最佳 42.4%评测于 2025年1月27日来源 OpenAI看逐题日志 ↗许可 CC BY 4.0

MATH Level 5数学

高难竞赛数学问题正确率。

默认档40.0%±

参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩

多次评分最佳 40.0%评测于 2025年1月27日来源 OpenAI看逐题日志 ↗许可 CC BY 4.0

配上 Agent 能做到什么

这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。

METR Time Horizons任务执行

在 METR 任务分布中达到约 50% 成功率的任务时长(分钟);结果包含评测执行环境。

默认档4.0

参加这项评测的全部模型 中位 55.1 · 最高 1044.8 · 共 50 个成绩

评测于 2023年11月6日来源 OpenAI许可 CC BY 4.0

用户点评

暂无公开评价

可以写下第一条评价。

发布匿名点评

评分
5
上传图片/视频

用户问答

暂无公开问答

你可以提出第一个问题。

提出问题

价格怎么算、买了能不能用、接口好不好接,都可以问问用过的人

上传图片/视频

gpt-4-1106-preview

gpt-4-1106-preview 是 ChatGPT 推出的对话模型。它支持提示缓存、工具调用。

模型介绍

gpt-4-1106-preview 是 ChatGPT 推出的对话模型。它支持提示缓存、工具调用。

模型基础信息

厂商
ChatGPT
模型类型
文本与多模态
能调工具吗
可以能不能自动调用外部函数、查资料、执行动作
它会做什么
会聊天 · 支持缓存省钱 · 可以设定角色 · 会调工具
怎么计费
按 Token 计费官方按什么单位收钱
现在还能用吗
有停用计划 · 状态来源
这些资料是哪个地区的
全球按厂商全球公布的资料显示;国内没单独公布时,也用这一份。
它还叫这些名字(18 条)
GPT 4 1106 PREVIEWGPT 4 1106 PREVIEW(azure · international)GPT 4 1106 PREVIEW(openai-api · international)GPT-4-1106-PREVIEWGPT-4-1106-PREVIEW(azure · international)GPT-4-1106-PREVIEW(openai-api · international)GPT_4_1106_PREVIEWGPT_4_1106_PREVIEW(azure · international)GPT_4_1106_PREVIEW(openai-api · international)gpt 4 1106 previewgpt 4 1106 preview(azure · international)gpt 4 1106 preview(openai-api · international)gpt-4-1106-previewgpt-4-1106-preview(azure · international)gpt-4-1106-preview(openai-api · international)gpt_4_1106_previewgpt_4_1106_preview(azure · international)gpt_4_1106_preview(openai-api · international)

不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。

官方价格

计价项适用范围官方价格
输入全球10 USD/ 1,000,000 token
输出全球30 USD/ 1,000,000 token

它有多强

成绩来自 Epoch AI, AI Benchmarking Hub (2026)
3 / 2020 项评测里,这个模型测过 3 项
模型自己的成绩
2
配上工具的成绩
1
换不同设置跑出的成绩
3

这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。

还有 17 项评测没测过这个模型
Aider PolyglotCyBenchDeepResearchBenchGDPvalOSWorldOSWorld 2SWE-bench VerifiedTerminal-BenchARC-AGI-2Epoch Capabilities IndexFrontierMathHumanity's Last ExamLiveBenchMirrorCodeSimpleBenchSimpleQA VerifiedVideo-MME

可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。

这个模型还没有可比的综合成绩,下面是它的单项成绩。

模型自己的成绩

同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。

GPQA Diamond推理

研究生级科学问答,衡量高难知识推理。

默认档42.4%±

参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩

多次评分最佳 42.4%评测于 2025年1月27日来源 OpenAI看逐题日志 ↗许可 CC BY 4.0

MATH Level 5数学

高难竞赛数学问题正确率。

默认档40.0%±

参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩

多次评分最佳 40.0%评测于 2025年1月27日来源 OpenAI看逐题日志 ↗许可 CC BY 4.0

配上 Agent 能做到什么

这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。

METR Time Horizons任务执行

在 METR 任务分布中达到约 50% 成功率的任务时长(分钟);结果包含评测执行环境。

默认档4.0

参加这项评测的全部模型 中位 55.1 · 最高 1044.8 · 共 50 个成绩

评测于 2023年11月6日来源 OpenAI许可 CC BY 4.0

中转服务商对比

筛选
综合参考分
验真通过率
相对官方价
18 家中转服务商
排序
中转服务商参考分输入/M Tokens输出/M Tokens缓存读/M Tokens缓存创建/M Tokens相对官方价验真通过率 / 更新时间
38.3
$0.1000-$18.00
$0.1000-$18.00
--
--
0.1官方无缓存参考
暂无报告更新 09/15 09:40
17.4
¥0.0300-¥1000.00
¥0.0300-¥1000.00
--
--
0.1官方无缓存参考
暂无报告更新 09/14 15:41

最新验真报告

下面是别人对这个模型做过的检测,按时间从新到旧排。

暂无公开报告

验真报告公开后会展示在这里。

用户点评

gpt-4-1106-preview综合评分--☆☆☆☆☆ 0 人点评
评分人数分布
★★★★★0
★★★★☆0
★★★☆☆0
★★☆☆☆0
★☆☆☆☆0
暂无公开点评

公开点评会展示在这里,登录后可以提交真实使用体验。

用户问答

暂无公开问答

你可以提出第一个问题。

提出问题

价格怎么算、买了能不能用、接口好不好接,都可以问问用过的人

上传图片/视频