MiniMax-M2.5
MiniMax · MiniMax-M2.5
M2.5 具备了「像架构师一样思考和构建」的能力,比如模型演化出了原生 Spec 行为:在动手写代码前,以架构师视角主动拆解功能、结构和 UI 设计,实现完整的前期规划。
M2.5 具备了「像架构师一样思考和构建」的能力,比如模型演化出了原生 Spec 行为:在动手写代码前,以架构师视角主动拆解功能、结构和 UI 设计,实现完整的前期规划。
折扣与价格评分按中国大陆的官方价计算
| 计价项 | 适用范围 | 官方价格 |
|---|---|---|
| 缓存读取 | 中国大陆 | 0.21 CNY/ 1,000,000 token |
| 缓存写入 | 中国大陆 | 2.625 CNY/ 1,000,000 token |
| 输入 | 中国大陆 | 2.1 CNY/ 1,000,000 token |
| 输出 | 中国大陆 | 8.4 CNY/ 1,000,000 token |
| 缓存读取 | 全球 | 0.2014 CNY/ 1,000,000 token |
| 缓存写入 | 全球 | 2.518 CNY/ 1,000,000 token |
| 输入 | 全球 | 2.014 CNY/ 1,000,000 token |
| 输出 | 全球 | 8.057 CNY/ 1,000,000 token |
不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
按第三方评测机构 Artificial Analysis 的智能指数,只跟当前在售的模型排名,每个模型按它最强的推理档位算:前 15% 为旗舰,15%–40% 为高端,40%–70% 为中端,其余为入门。只比能力,不看价格。
科学难题、数学和没见过的新题,看它想得清不清楚。
从没见过的图形规律题,靠现场推理而不是背题。看它遇到新问题会不会举一反三。
自己动手写代码、改代码、跑通工程任务。标了「配工具」的成绩是模型加上评测方的工具和运行环境跑出来的,换一套工具结果会变,不算进上面的名次。
让模型在命令行里独立完成装环境、改代码、跑测试等真实工程任务。用它写代码、做自动化时看这项。
厂商官方接口的实测中位数,看它回答快不快;不代表任何中转站线路的快慢。
厂商官方接口开始回答后,每秒能吐出多少 Token 的实测中位数。不代表中转站线路的快慢。
向厂商官方接口提问后,要等几秒才看到回答的第一个字(思考模型包括思考时间)的实测中位数。越短越好,不代表中转站线路。
这些评测停止更新、有成绩的模型太少或者和选购关系不大,成绩仅供参考,不影响上面的名次和用途筛选。
Epoch AI 把几十项前沿评测合成的一个能力指数,用来看模型整体有多强。
不再排行的原因:综合能力已改按 Artificial Analysis 智能指数排名(覆盖的在售模型多一倍);Epoch 综合指数留作第二来源参考。
还没有人点评。用过的话,写下第一条真实体验,帮后来的人少踩坑。