GPT-5.1 (2025-11-13)
OpenAI · gpt-5.1-2025-11-13
GPT-5.1 是我们用于编程和智能体(agentic)任务的旗舰模型,具有可配置的推理与非推理工作量(effort)。请在我们的 GPT-5.1 模型指南 中了解更多信息。Reasoning.effort 支持:none(默认)、low、medium 和 high。
OpenAI · gpt-5.1-2025-11-13
GPT-5.1 是我们用于编程和智能体(agentic)任务的旗舰模型,具有可配置的推理与非推理工作量(effort)。请在我们的 GPT-5.1 模型指南 中了解更多信息。Reasoning.effort 支持:none(默认)、low、medium 和 high。
GPT-5.1 是我们用于编程和智能体(agentic)任务的旗舰模型,具有可配置的推理与非推理工作量(effort)。请在我们的 GPT-5.1 模型指南 中了解更多信息。
GPT-5.1 是我们用于编程和智能体(agentic)任务的旗舰模型,具有可配置的推理与非推理工作量(effort)。请在我们的 GPT-5.1 模型指南 中了解更多信息。Reasoning.effort 支持:none(默认)、low、medium 和 high。
不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
| 计价项 | 适用范围 | 官方价格 |
|---|---|---|
| 缓存读取 | 全球 | 0.125 USD/ 1,000,000 token |
| 输入 | 全球 | 1.25 USD/ 1,000,000 token |
| 输出 | 全球 | 10 USD/ 1,000,000 token |
这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。
可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。
这个模型还没有可比的综合成绩,下面是它的单项成绩。
同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。
这个模型还没有可公开的单项成绩。
这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。
这个模型还没有出现在 SWE-bench、Terminal-Bench 一类的 Agent 评测里。
可以写下第一条评价。
你可以提出第一个问题。
GPT-5.1 是我们用于编程和智能体(agentic)任务的旗舰模型,具有可配置的推理与非推理工作量(effort)。请在我们的 GPT-5.1 模型指南 中了解更多信息。Reasoning.effort 支持:none(默认)、low、medium 和 high。
GPT-5.1 是我们用于编程和智能体(agentic)任务的旗舰模型,具有可配置的推理与非推理工作量(effort)。请在我们的 GPT-5.1 模型指南 中了解更多信息。
GPT-5.1 是我们用于编程和智能体(agentic)任务的旗舰模型,具有可配置的推理与非推理工作量(effort)。请在我们的 GPT-5.1 模型指南 中了解更多信息。Reasoning.effort 支持:none(默认)、low、medium 和 high。
不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
| 计价项 | 适用范围 | 官方价格 |
|---|---|---|
| 缓存读取 | 全球 | 0.125 USD/ 1,000,000 token |
| 输入 | 全球 | 1.25 USD/ 1,000,000 token |
| 输出 | 全球 | 10 USD/ 1,000,000 token |
这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。
可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。
这个模型还没有可比的综合成绩,下面是它的单项成绩。
同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。
这个模型还没有可公开的单项成绩。
这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。
这个模型还没有出现在 SWE-bench、Terminal-Bench 一类的 Agent 评测里。
下面是别人对这个模型做过的检测,按时间从新到旧排。
验真报告公开后会展示在这里。
公开点评会展示在这里,登录后可以提交真实使用体验。
你可以提出第一个问题。