GPT-4o mini (2024-07-18)
OpenAI · gpt-4o-mini-2024-07-18
GPT-4o Mini(“o”代表“omni”)是一款快速、经济实惠的小型模型,适用于专注特定任务。它同时接受文本和图像输入,并生成文本输出(包括结构化输出)。它非常适合微调,并且可以将像 GPT-4o 这样更大模型的模型输出蒸馏至 GPT-4o-Mini,从而以更低的成本和延迟产生类似的结果。
OpenAI · gpt-4o-mini-2024-07-18
GPT-4o Mini(“o”代表“omni”)是一款快速、经济实惠的小型模型,适用于专注特定任务。它同时接受文本和图像输入,并生成文本输出(包括结构化输出)。它非常适合微调,并且可以将像 GPT-4o 这样更大模型的模型输出蒸馏至 GPT-4o-Mini,从而以更低的成本和延迟产生类似的结果。
GPT-4o Mini(“o”代表“omni”)是一款快速、经济实惠的小型模型,适用于专注特定任务。它同时接受文本和图像输入,并生成文本输出(包括结构化输出)。
GPT-4o Mini(“o”代表“omni”)是一款快速、经济实惠的小型模型,适用于专注特定任务。它同时接受文本和图像输入,并生成文本输出(包括结构化输出)。它非常适合微调,并且可以将像 GPT-4o 这样更大模型的模型输出蒸馏至 GPT-4o-Mini,从而以更低的成本和延迟产生类似的结果。
不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
全球 · 价格附有适用条件
| 计价项 / 适用范围 | 适用条件 | 官方价格 |
|---|---|---|
| 缓存读取 全球 · openai-api | fine_tuned:true采集于 2026-09-15 | 0.15 USD/ 1,000,000 Token |
| 缓存读取 全球 · openai-api | 未附加计价条件采集于 2026-09-15 | 0.075 USD/ 1,000,000 Token |
| 输入 全球 · openai-api | fine_tuned:true采集于 2026-09-15 | 0.3 USD/ 1,000,000 Token |
| 输入 全球 · openai-api | 未附加计价条件采集于 2026-09-15 | 0.15 USD/ 1,000,000 Token |
| 输出 全球 · openai-api | 未附加计价条件采集于 2026-09-15 | 0.6 USD/ 1,000,000 Token |
| 输出 全球 · openai-api | fine_tuned:true采集于 2026-09-15 | 1.2 USD/ 1,000,000 Token |
这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。
可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。
这个模型还没有可比的综合成绩,下面是它的单项成绩。
同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。
新颖抽象规则归纳与泛化能力。
参加这项评测的全部模型 中位 9.86% · 最高 95.0% · 共 203 个成绩
研究生级科学问答,衡量高难知识推理。
参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩
使用持续更新题目降低污染风险的综合能力评测。
参加这项评测的全部模型 中位 52.4 · 最高 82.3 · 共 52 个成绩
高难竞赛数学问题正确率。
参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩
以多次作答平均分衡量常识与推理能力。
参加这项评测的全部模型 中位 49.5% · 最高 81.9% · 共 102 个成绩
短事实问答准确性,关注事实性而非表达偏好。
参加这项评测的全部模型 中位 40.4% · 最高 75.6% · 共 80 个成绩
长短视频理解能力,采用无字幕正确率。
参加这项评测的全部模型 中位 63.1% · 最高 79.7% · 共 50 个成绩
这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。
多语言代码编辑任务;结果包含 Aider 执行框架影响。
参加这项评测的全部模型 中位 53.8% · 最高 88.0% · 共 71 个成绩
Be the first to leave a review.
Be the first to ask a question.
GPT-4o Mini(“o”代表“omni”)是一款快速、经济实惠的小型模型,适用于专注特定任务。它同时接受文本和图像输入,并生成文本输出(包括结构化输出)。它非常适合微调,并且可以将像 GPT-4o 这样更大模型的模型输出蒸馏至 GPT-4o-Mini,从而以更低的成本和延迟产生类似的结果。
GPT-4o Mini(“o”代表“omni”)是一款快速、经济实惠的小型模型,适用于专注特定任务。它同时接受文本和图像输入,并生成文本输出(包括结构化输出)。
GPT-4o Mini(“o”代表“omni”)是一款快速、经济实惠的小型模型,适用于专注特定任务。它同时接受文本和图像输入,并生成文本输出(包括结构化输出)。它非常适合微调,并且可以将像 GPT-4o 这样更大模型的模型输出蒸馏至 GPT-4o-Mini,从而以更低的成本和延迟产生类似的结果。
不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
全球 · 价格附有适用条件
| 计价项 / 适用范围 | 适用条件 | 官方价格 |
|---|---|---|
| 缓存读取 全球 · openai-api | fine_tuned:true采集于 2026-09-15 | 0.15 USD/ 1,000,000 Token |
| 缓存读取 全球 · openai-api | 未附加计价条件采集于 2026-09-15 | 0.075 USD/ 1,000,000 Token |
| 输入 全球 · openai-api | fine_tuned:true采集于 2026-09-15 | 0.3 USD/ 1,000,000 Token |
| 输入 全球 · openai-api | 未附加计价条件采集于 2026-09-15 | 0.15 USD/ 1,000,000 Token |
| 输出 全球 · openai-api | 未附加计价条件采集于 2026-09-15 | 0.6 USD/ 1,000,000 Token |
| 输出 全球 · openai-api | fine_tuned:true采集于 2026-09-15 | 1.2 USD/ 1,000,000 Token |
这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。
可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。
这个模型还没有可比的综合成绩,下面是它的单项成绩。
同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。
新颖抽象规则归纳与泛化能力。
参加这项评测的全部模型 中位 9.86% · 最高 95.0% · 共 203 个成绩
研究生级科学问答,衡量高难知识推理。
参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩
使用持续更新题目降低污染风险的综合能力评测。
参加这项评测的全部模型 中位 52.4 · 最高 82.3 · 共 52 个成绩
高难竞赛数学问题正确率。
参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩
以多次作答平均分衡量常识与推理能力。
参加这项评测的全部模型 中位 49.5% · 最高 81.9% · 共 102 个成绩
短事实问答准确性,关注事实性而非表达偏好。
参加这项评测的全部模型 中位 40.4% · 最高 75.6% · 共 80 个成绩
长短视频理解能力,采用无字幕正确率。
参加这项评测的全部模型 中位 63.1% · 最高 79.7% · 共 50 个成绩
这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。
多语言代码编辑任务;结果包含 Aider 执行框架影响。
参加这项评测的全部模型 中位 53.8% · 最高 88.0% · 共 71 个成绩
下面是别人对这个模型做过的检测,按时间从新到旧排。
Verification reports show up here once they are public.
Public reviews will appear here. Sign in to share real usage experience.
Be the first to ask a question.