Model details

Qwen Plus 2025-01-25

Qwen · qwen-plus-2025-01-25

千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。相对于通义千问-Plus-2025-0112版本,整体中英文能力都有综合能力升级,中英文code能力、逻辑能力、多语言能力显著提升,回复风格面向人类偏好进行大幅调整,尤其是数学、逻辑推理、知识问答等客观类query,模型回复详实程度和格式清晰度明显改善,创作类专项、json格式遵循专项、角色扮演专项能力均定向提升,预计维护至下一个快照上线前一个月。

模型介绍

千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。

展开完整介绍

千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。相对于通义千问-Plus-2025-0112版本,整体中英文能力都有综合能力升级,中英文code能力、逻辑能力、多语言能力显著提升,回复风格面向人类偏好进行大幅调整,尤其是数学、逻辑推理、知识问答等客观类query,模型回复详实程度和格式清晰度明显改善,创作类专项、json格式遵循专项、角色扮演专项能力均定向提升,预计维护至下一个快照上线前一个月。

查看介绍来源

模型基础信息

厂商
通义千问
模型类型
文本与多模态
能调工具吗
可以能不能自动调用外部函数、查资料、执行动作
它会做什么
会聊天 · 擅长推理 · 会调工具
怎么计费
按 Token 计费官方按什么单位收钱
现在还能用吗
在售 · 状态来源官方在售,可以正常调用。
这些资料是哪个地区的
中国大陆厂商专门为中国大陆公布的资料。
它还叫这些名字(31 条)
QWEN PLUS 2025 01 25QWEN PLUS 2025 01 25(alibaba-model-studio-cn · cn_mainland)QWEN-PLUS-2025-01-25QWEN-PLUS-2025-01-25(alibaba-model-studio-cn · cn_mainland)QWEN_PLUS_2025_01_25QWEN_PLUS_2025_01_25(alibaba-model-studio-cn · cn_mainland)Qwen Plus 2025 01 25Qwen Plus 2025-01-25Qwen-Plus-2025-01-25Qwen_Plus_2025_01_25qwen plus 2025 01 25qwen plus 2025 01 25(alibaba-model-studio-cn · cn_mainland)qwen-plus-2025-01-25qwen-plus-2025-01-25(alibaba-model-studio-cn · cn_mainland)qwen_plus_2025_01_25qwen_plus_2025_01_25(alibaba-model-studio-cn · cn_mainland)通义千问 PLUS 2025 01 25通义千问 PLUS 2025 01 25(alibaba-model-studio-cn · cn_mainland)通义千问 Plus 2025 01 25通义千问 plus 2025 01 25通义千问 plus 2025 01 25(alibaba-model-studio-cn · cn_mainland)通义千问-PLUS-2025-01-25通义千问-PLUS-2025-01-25(alibaba-model-studio-cn · cn_mainland)通义千问-Plus-2025-01-25通义千问-plus-2025-01-25通义千问-plus-2025-01-25(alibaba-model-studio-cn · cn_mainland)通义千问_PLUS_2025_01_25通义千问_PLUS_2025_01_25(alibaba-model-studio-cn · cn_mainland)通义千问_Plus_2025_01_25通义千问_plus_2025_01_25通义千问_plus_2025_01_25(alibaba-model-studio-cn · cn_mainland)

不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。

官方价格

计价项适用范围官方价格
输入中国大陆0.8 CNY/ 1,000,000 token
输出中国大陆2 CNY/ 1,000,000 token

它有多强

成绩来自 Epoch AI, AI Benchmarking Hub (2026)
2 / 2020 项评测里,这个模型测过 2 项
模型自己的成绩
2
配上工具的成绩
0
换不同设置跑出的成绩
2

这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。

还有 18 项评测没测过这个模型
Aider PolyglotCyBenchDeepResearchBenchGDPvalMETR Time HorizonsOSWorldOSWorld 2SWE-bench VerifiedTerminal-BenchARC-AGI-2Epoch Capabilities IndexFrontierMathHumanity's Last ExamLiveBenchMirrorCodeSimpleBenchSimpleQA VerifiedVideo-MME

可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。

这个模型还没有可比的综合成绩,下面是它的单项成绩。

模型自己的成绩

同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。

GPQA Diamond推理

研究生级科学问答,衡量高难知识推理。

默认档48.1%±

参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩

多次评分最佳 48.1%评测于 2025年4月8日来源 Alibaba看逐题日志 ↗许可 CC BY 4.0

MATH Level 5数学

高难竞赛数学问题正确率。

默认档65.3%±

参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩

多次评分最佳 65.3%评测于 2025年4月8日来源 Alibaba看逐题日志 ↗许可 CC BY 4.0

配上 Agent 能做到什么

这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。

这个模型还没有出现在 SWE-bench、Terminal-Bench 一类的 Agent 评测里。

User reviews

No public reviews

Be the first to leave a review.

Post an anonymous review

Rating
5 points
Upload images/video

Questions & answers

No public questions

Be the first to ask a question.

Ask a question

Ask people who bought it how pricing works, whether it works after purchase, and how easy the API is to hook up

Upload images/video

Qwen Plus 2025-01-25

千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。相对于通义千问-Plus-2025-0112版本,整体中英文能力都有综合能力升级,中英文code能力、逻辑能力、多语言能力显著提升,回复风格面向人类偏好进行大幅调整,尤其是数学、逻辑推理、知识问答等客观类query,模型回复详实程度和格式清晰度明显改善,创作类专项、json格式遵循专项、角色扮演专项能力均定向提升,预计维护至下一个快照上线前一个月。

模型介绍

千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。

展开完整介绍

千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。相对于通义千问-Plus-2025-0112版本,整体中英文能力都有综合能力升级,中英文code能力、逻辑能力、多语言能力显著提升,回复风格面向人类偏好进行大幅调整,尤其是数学、逻辑推理、知识问答等客观类query,模型回复详实程度和格式清晰度明显改善,创作类专项、json格式遵循专项、角色扮演专项能力均定向提升,预计维护至下一个快照上线前一个月。

查看介绍来源

模型基础信息

厂商
通义千问
模型类型
文本与多模态
能调工具吗
可以能不能自动调用外部函数、查资料、执行动作
它会做什么
会聊天 · 擅长推理 · 会调工具
怎么计费
按 Token 计费官方按什么单位收钱
现在还能用吗
在售 · 状态来源官方在售,可以正常调用。
这些资料是哪个地区的
中国大陆厂商专门为中国大陆公布的资料。
它还叫这些名字(31 条)
QWEN PLUS 2025 01 25QWEN PLUS 2025 01 25(alibaba-model-studio-cn · cn_mainland)QWEN-PLUS-2025-01-25QWEN-PLUS-2025-01-25(alibaba-model-studio-cn · cn_mainland)QWEN_PLUS_2025_01_25QWEN_PLUS_2025_01_25(alibaba-model-studio-cn · cn_mainland)Qwen Plus 2025 01 25Qwen Plus 2025-01-25Qwen-Plus-2025-01-25Qwen_Plus_2025_01_25qwen plus 2025 01 25qwen plus 2025 01 25(alibaba-model-studio-cn · cn_mainland)qwen-plus-2025-01-25qwen-plus-2025-01-25(alibaba-model-studio-cn · cn_mainland)qwen_plus_2025_01_25qwen_plus_2025_01_25(alibaba-model-studio-cn · cn_mainland)通义千问 PLUS 2025 01 25通义千问 PLUS 2025 01 25(alibaba-model-studio-cn · cn_mainland)通义千问 Plus 2025 01 25通义千问 plus 2025 01 25通义千问 plus 2025 01 25(alibaba-model-studio-cn · cn_mainland)通义千问-PLUS-2025-01-25通义千问-PLUS-2025-01-25(alibaba-model-studio-cn · cn_mainland)通义千问-Plus-2025-01-25通义千问-plus-2025-01-25通义千问-plus-2025-01-25(alibaba-model-studio-cn · cn_mainland)通义千问_PLUS_2025_01_25通义千问_PLUS_2025_01_25(alibaba-model-studio-cn · cn_mainland)通义千问_Plus_2025_01_25通义千问_plus_2025_01_25通义千问_plus_2025_01_25(alibaba-model-studio-cn · cn_mainland)

不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。

官方价格

计价项适用范围官方价格
输入中国大陆0.8 CNY/ 1,000,000 token
输出中国大陆2 CNY/ 1,000,000 token

它有多强

成绩来自 Epoch AI, AI Benchmarking Hub (2026)
2 / 2020 项评测里,这个模型测过 2 项
模型自己的成绩
2
配上工具的成绩
0
换不同设置跑出的成绩
2

这里只算能确认就是这个型号的公开成绩。没成绩不代表它不行,我们也不会给它记 0 分。

还有 18 项评测没测过这个模型
Aider PolyglotCyBenchDeepResearchBenchGDPvalMETR Time HorizonsOSWorldOSWorld 2SWE-bench VerifiedTerminal-BenchARC-AGI-2Epoch Capabilities IndexFrontierMathHumanity's Last ExamLiveBenchMirrorCodeSimpleBenchSimpleQA VerifiedVideo-MME

可能是没人测过,也可能是名字对不上号。我们宁可空着,也不拿差不多的成绩硬凑。

这个模型还没有可比的综合成绩,下面是它的单项成绩。

模型自己的成绩

同一道题直接问模型,不给它工具。每项都标出参加这项评测的全部模型的中位分和最高分,方便对照。

GPQA Diamond推理

研究生级科学问答,衡量高难知识推理。

默认档48.1%±

参加这项评测的全部模型 中位 74.2% · 最高 95.8% · 共 313 个成绩

多次评分最佳 48.1%评测于 2025年4月8日来源 Alibaba看逐题日志 ↗许可 CC BY 4.0

MATH Level 5数学

高难竞赛数学问题正确率。

默认档65.3%±

参加这项评测的全部模型 中位 59.4% · 最高 98.1% · 共 108 个成绩

多次评分最佳 65.3%评测于 2025年4月8日来源 Alibaba看逐题日志 ↗许可 CC BY 4.0

配上 Agent 能做到什么

这不是模型自己的分数。下面的成绩是模型配上评测方的工具和运行环境跑出来的,换一套工具结果就会变。它们不算进上面的档位,也不能拿来排模型强弱。

这个模型还没有出现在 SWE-bench、Terminal-Bench 一类的 Agent 评测里。

Provider comparison

Filters
Overall reference score
Pass rate
Vs official price
Total 14 providers
Sort
ProviderReference scoreInput/M TokensOutput/M TokensCache read/M TokensCache write/M TokensVs official pricePass rate / Updated
10.9
$1.760-$3.600
$4.400-$9.000
--
--
over official1380%No official cache reference
No reportsUpdated 09/13 07:00

Latest verification reports

下面是别人对这个模型做过的检测,按时间从新到旧排。

No public reports

Verification reports show up here once they are public.

User reviews

Qwen Plus 2025-01-25Overall score--☆☆☆☆☆Total 0 reviews
Rating distribution
★★★★★0 people
★★★★☆0 people
★★★☆☆0 people
★★☆☆☆0 people
★☆☆☆☆0 people
No public reviews

Public reviews will appear here. Sign in to share real usage experience.

Questions & answers

No public questions

Be the first to ask a question.

Ask a question

Ask people who bought it how pricing works, whether it works after purchase, and how easy the API is to hook up

Upload images/video