模型介绍
千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。
展开完整介绍
千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。相对于通义千问-Plus-2025-0112版本,整体中英文能力都有综合能力升级,中英文code能力、逻辑能力、多语言能力显著提升,回复风格面向人类偏好进行大幅调整,尤其是数学、逻辑推理、知识问答等客观类query,模型回复详实程度和格式清晰度明显改善,创作类专项、json格式遵循专项、角色扮演专项能力均定向提升,预计维护至下一个快照上线前一个月。
查看介绍来源模型基础信息
- 厂商
- 通义千问
- 模型类型
- 文本与多模态
- 能调工具吗
- 可以能不能自动调用外部函数、查资料、执行动作
- 它会做什么
- 会聊天 · 擅长推理 · 会调工具
- 怎么计费
- 按 Token 计费官方按什么单位收钱
- 现在还能用吗
- 在售 · 状态来源官方在售,可以正常调用。
- 这些资料是哪个地区的
- 中国大陆厂商专门为中国大陆公布的资料。
它还叫这些名字(31 条)
QWEN PLUS 2025 01 25QWEN PLUS 2025 01 25(alibaba-model-studio-cn · cn_mainland)QWEN-PLUS-2025-01-25QWEN-PLUS-2025-01-25(alibaba-model-studio-cn · cn_mainland)QWEN_PLUS_2025_01_25QWEN_PLUS_2025_01_25(alibaba-model-studio-cn · cn_mainland)Qwen Plus 2025 01 25Qwen Plus 2025-01-25Qwen-Plus-2025-01-25Qwen_Plus_2025_01_25qwen plus 2025 01 25qwen plus 2025 01 25(alibaba-model-studio-cn · cn_mainland)qwen-plus-2025-01-25qwen-plus-2025-01-25(alibaba-model-studio-cn · cn_mainland)qwen_plus_2025_01_25qwen_plus_2025_01_25(alibaba-model-studio-cn · cn_mainland)通义千问 PLUS 2025 01 25通义千问 PLUS 2025 01 25(alibaba-model-studio-cn · cn_mainland)通义千问 Plus 2025 01 25通义千问 plus 2025 01 25通义千问 plus 2025 01 25(alibaba-model-studio-cn · cn_mainland)通义千问-PLUS-2025-01-25通义千问-PLUS-2025-01-25(alibaba-model-studio-cn · cn_mainland)通义千问-Plus-2025-01-25通义千问-plus-2025-01-25通义千问-plus-2025-01-25(alibaba-model-studio-cn · cn_mainland)通义千问_PLUS_2025_01_25通义千问_PLUS_2025_01_25(alibaba-model-studio-cn · cn_mainland)通义千问_Plus_2025_01_25通义千问_plus_2025_01_25通义千问_plus_2025_01_25(alibaba-model-studio-cn · cn_mainland)不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。
官方价格
| 计价项 | 适用范围 | 官方价格 |
|---|
| 输入 | 中国大陆 | 0.8 CNY/ 1,000,000 token |
| 输出 | 中国大陆 | 2 CNY/ 1,000,000 token |
它有多强
成绩来自 Epoch AI, AI Benchmarking Hub (2026)2 / 20 项20 项评测里,这个模型测过 2 项
- 模型自己的成绩
- 2 项
- 配上工具的成绩
- 0 项
- 换不同设置跑出的成绩
- 2 次
这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。
还有 18 项评测没测过这个模型
Aider PolyglotCyBenchDeepResearchBenchGDPvalMETR Time HorizonsOSWorldOSWorld 2SWE-bench VerifiedTerminal-BenchARC-AGI-2Epoch Capabilities IndexFrontierMathHumanity's Last ExamLiveBenchMirrorCodeSimpleBenchSimpleQA VerifiedVideo-MME可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。
这个模型还没有可比的综合成绩,下面是它的单项成绩。
模型自己的成绩
同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。
GPQA Diamond推理
研究生级科学问答,衡量高难知识推理。
默认档48.1%±
参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩
多次评分最佳 48.1%评测于 2025年4月8日来源 Alibaba ↗看逐题日志 ↗许可 CC BY 4.0
MATH Level 5数学
高难竞赛数学问题正确率。
默认档65.3%±
参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩
多次评分最佳 65.3%评测于 2025年4月8日来源 Alibaba ↗看逐题日志 ↗许可 CC BY 4.0
配上 Agent 能做到什么
这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。
这个模型还没有出现在 SWE-bench、Terminal-Bench 一类的 Agent 评测里。