模型详情

Qwen3.5 Flash

Qwen · qwen3.5-flash

Qwen3.5原生视觉语言系列Flash模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步;响应速度快,兼具推理速度和性能。

Qwen3.5 Flash

Qwen3.5原生视觉语言系列Flash模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步;响应速度快,兼具推理速度和性能。

查看介绍来源
官方价 · 输入¥0.2000
官方价 · 输出¥2.000
多少家在卖85 家
公开验真报告2 份
还没有人点评,来写第一条看口碑 ↓

模型基础信息

厂商
通义千问
模型类型
文本与多模态
一次能读多少
1M Token一次对话能塞进去的最大内容量,长文档、长代码要看这项
一次能写多少
65,536 Token单次回答的长度上限
能接收什么
图像 · 文本 · 视频可以发给它的内容类型
能产出什么
文本它能生成的内容类型
能看图吗
可以
能调工具吗
可以能不能自动调用外部函数、查资料、执行动作
怎么计费
按 Token 计费官方按什么单位收钱
现在还能用吗
可以用 · 状态来源阿里云 Model Studio 官方模型目录核对
这些资料是哪个地区的资料适用地区
中国大陆厂商专门为中国大陆公布的资料。
它会做什么能读上传的文件擅长推理支持结构化输出回答风格可调会写字会调工具会看图

官方价格

输入 · 中国大陆
0.2 CNY每 100 万 Token
输出 · 中国大陆
2 CNY每 100 万 Token
缓存写入 · 中国大陆
0.25 CNY每 100 万 Token

中国大陆 / 全球 · 按适用条件分档计价

折扣与价格评分按中国大陆的官方价计算

查看分档价格

缓存读取

不分档0.0671 CNY/ 百万 Token
缓存方式:显式缓存,输入 128,000 Token 以内0.02 CNY/ 百万 Token
缓存方式:显式缓存,输入 256,000 Token 以内,输入 128,000 Token 以上0.08 CNY/ 百万 Token
缓存方式:显式缓存,输入 1,000,000 Token 以内,输入 256,000 Token 以上0.12 CNY/ 百万 Token
缓存方式:显式缓存0.02 CNY/ 百万 Token

缓存写入

不分档0.8393 CNY/ 百万 Token
输入 128,000 Token 以内0.25 CNY/ 百万 Token
输入 256,000 Token 以内,输入 128,000 Token 以上1 CNY/ 百万 Token
输入 1,000,000 Token 以内,输入 256,000 Token 以上1.5 CNY/ 百万 Token

输入

不分档0.6715 CNY/ 百万 Token
输入 128,000 Token 以内0.2 CNY/ 百万 Token
输入 256,000 Token 以内,输入 128,000 Token 以上0.8 CNY/ 百万 Token
输入 1,000,000 Token 以内,输入 256,000 Token 以上1.2 CNY/ 百万 Token

输出

不分档2.686 CNY/ 百万 Token
输入 128,000 Token 以内2 CNY/ 百万 Token
输入 256,000 Token 以内,输入 128,000 Token 以上8 CNY/ 百万 Token
输入 1,000,000 Token 以内,输入 256,000 Token 以上12 CNY/ 百万 Token

中国大陆 / 全球 · 采集于 2026-10-02 · 查看价格来源

它还叫这些名字(2 条)
Qwen3.5-Flash通义千问-3.5-Flash

不同地方写法可能不一样,列在这里方便你对上号。名字太模糊、认不准的不会公开。

用户口碑

还没有人点评。用过的话,写下第一条真实体验,帮后来的人少踩坑。

发布模型点评

评分
5 分

用户问答

提出问题

价格怎么算、买了能不能用、接口好不好接,都可以问问用过的人