QWEN MODEL SELECTION GUIDE · 2026
EN

通义千问模型选择指南

通义千问(Qwen)全系列模型解析 · 混合思考 · 全模态 · 视觉生成 · 语音全链路 · 开源部署 — 数据来源:阿里云百炼官方文档 模型大全 · 模型价格 · 分类文档(2026-08-30 同步)

138收录模型
12模型分类
10M最大上下文
定位
旗舰均衡经济
响应速度
极速快速标准较慢很慢
模态能力
文本图像音频视频代码
推理强度
最强深度标准基础快速
价格档位
天价¥20+ / ¥72+昂贵¥8-20 / ¥36-72较贵¥2-8 / ¥8-36适中¥0.5-2 / ¥2-8实惠¥0.1-0.5 / ¥0.4-2白菜价<¥0.1 / <¥0.4单位:元 CNY / 1M tokens(输入 / 输出),华北2(北京)原价

快速选型

按任务类型直达推荐模型

日常对话 / 写作qwen3.7-plus
深度思考 / 推理qwen3.8-max
最强旗舰qwen3.8-max-prime
极致省钱qwen3.7-flash
专业编程qwen3-coder-plus
超长文档处理qwen-long
图像 / 视频理解qwen3-vl-plus
全模态对话qwen3.5-omni-plus
实时语音对话qwen-audio-3.0-realtime-plus
语音听录qwen-audio-3.0-asr-flash-filetrans
语音合成qwen-audio-3.0-tts-plus
图像生成qwen-image-3.0-pro
视频生成happyhorse-1.1-t2v
语义搜索 / RAGtext-embedding-v4
实时语音翻译qwen3.5-livetranslate-flash-realtime

命名规律速查

掌握这些规律,看到任何模型名都能秒懂其定位

命名元素含义示例
qwen3.X 版本号 数字越大,模型越新越强 qwen3 → qwen3.5 → qwen3.8
-max 旗舰版,最强能力 qwen3.8-max
-prime 优速模式,更快更强更贵 qwen3.8-max-prime
-plus 均衡增强版 qwen3.7-plus
-flash 轻量快速,极致省钱 qwen3.7-flash
-turbo 速度优化版(旧代) qwen-turbo
qwq- 深度思考专用(仅思考模式) qwq-plus
-coder 编程专用 qwen3-coder-plus
-long 超长文本专用 qwen-long
-vl 视觉语言模型 qwen3-vl-plus
-omni 全模态(文/图/音/视频) qwen3.5-omni-plus
-ocr 文档文字提取 qwen3.5-ocr
-asr / -tts 语音识别 / 语音合成 qwen-audio-3.0-asr-flash
-realtime WebSocket 实时版 qwen3.5-omni-plus-realtime
-filetrans / -streaming 文件转写 / 流式实时 qwen-audio-3.0-asr-flash-filetrans
-livetranslate 实时语音翻译 qwen3.5-livetranslate-flash
-instruct / -vc / -vd 指令控制 / 声音复刻 / 声音设计 qwen3-tts-instruct-flash
-embedding / -rerank 向量化 / 重排序 text-embedding-v4, qwen3-rerank
wan2.X- 万相视觉生成(图像/视频) wan2.7-image, wan2.6-t2v
-t2i/-t2v/-i2v/-r2v/-s2v 文生图/文生视频/图生视频/参考视频/声生视频 wan2.6-t2i, wan2.6-r2v
-latest / -YYYYMMDD 最新快照 / 日期快照 qwen3.7-plus-2026-05-26
cosyvoice- / fun-asr- 语音合成 / 语音识别系列 cosyvoice-v3.5-plus, fun-asr
z-image- / happyhorse- 快速图像 / 第三方视频生成 z-image-turbo, happyhorse-1.1-t2v

文本生成模型

千问主力文本模型,全系支持混合思考模式(enable_thinking 开关)与 1M 上下文;视觉输入能力见「视觉理解」章节

模型 ID定位价格模态思考速度上下文最大输出说明
qwen3.8-max-primeNEW 旗舰
最强 较慢 1M 64k 优速模式(Prime),当前最强,¥24/¥72
qwen3.8-maxNEW 旗舰
最强 较慢 1M 64k 最新旗舰,混合思考默认开启,¥12/¥36
qwen3.7-max 旗舰
最强 较慢 1M 64k 上代旗舰,限时 5 折
qwen3.7-plus推荐 均衡
深度 标准 1M 64k 旗舰平衡之选,¥2/¥8(限时 8 折),内置工具+联网
qwen3.8-27bNEW 均衡
深度 标准 1M 64k 稠密 27B 版(1M 上下文),¥3/¥12
qwen3.6-plus 均衡
深度 标准 1M 64k 上代均衡版
qwen3.5-flash 经济
基础 快速 1M 64k 上代轻量版,¥0.2 起
qwen3.5-plus 均衡
标准 标准 1M 64k 成熟稳定
qwen3.8-flashNEW 经济
标准 快速 1M 64k 最新轻量版,混合思考默认开启,¥0.8/¥2.7
qwen3.7-flash推荐 经济
基础 快速 1M 64k 极致省钱,¥0.2/¥0.8
qwen3.6-flash 经济
标准 快速 1M 64k 上代轻量版
qwen3-coder-plus 旗舰
深度 标准 1M 64k 编程专用,Agentic 编程优化,¥4/¥16
qwen-long 经济
基础 标准 10M 8k 超长文本专用(千万字级),¥0.5/¥2
qwen-mt-plus 均衡
基础 快速 机器翻译专用,多语言互译
qwen3-max 均衡
深度 较慢 128K 32k Qwen3 代旗舰(旧代),¥2.5 起

QwQ 深度思考模型

仅思考模式(始终先推理再回答,不可关闭);若需可控开关,请用文本生成模型的混合思考模式

模型 ID定位价格模态思考速度上下文最大输出说明
qwq-plus推荐 均衡
最强 较慢 128K 32k 仅思考模式,逻辑/数学推理专用,¥1.6/¥4

全模态模型(Omni)

同时理解文本、音频、图片、视频,输出文本和语音;实时语音对话见「实时语音对话」行

模型 ID定位价格输入输出API思考特性说明
qwen3.5-omni-plus 旗舰
HTTP 快速 FC+联网 全模态旗舰,音频 3 小时 / 视频 1 小时
qwen3.5-omni-plus-realtime 旗舰
WebSocket 快速 FC+联网 实时音视频对话
qwen3.5-omni-flash 均衡
HTTP 快速 FC+联网 轻量全模态,¥2.2 起
qwen3.5-omni-flash-realtime 均衡
WebSocket 快速 FC+联网 实时版
qwen3-omni-flash 经济
HTTP 标准 FC 支持思考模式,单次输入限 150 秒
qwen3-omni-flash-realtime 经济
WebSocket 快速 实时版,不支持 FC/联网/思考
qwen-audio-3.0-realtime-plusNEW 旗舰
WebSocket 快速 语义VAD+FC S2S 语音对话旗舰,无意义附和声不打断
qwen-audio-3.0-realtime-flashNEW 经济
WebSocket 快速 语义VAD+FC 成本敏感版语音对话
qwen-omni-turbo 经济
HTTP 快速 旧版全模态,建议迁移 qwen3.5-omni

实时语音翻译(Livetranslate)

语音同传约 3 秒延迟,开箱即用;文件模式支持音视频文件翻译

模型 ID定位价格输入API语言数说明
qwen3.5-livetranslate-flash-realtimeNEW推荐 均衡 音频 ¥40/1M
WebSocket 60 实时同传首选,29 种语音+31 种文本输出
qwen3.5-livetranslate-flash 均衡 音频 ¥40/1M
HTTP 60 音视频文件翻译
qwen3-livetranslate-flash-realtime 经济 音频 ¥64/1M
WebSocket 18 上代实时版,含 5 种中文方言
qwen3-livetranslate-flash 经济 音频 ¥10/1M
HTTP 18 文件模式,视频上下文感知

视觉理解模型(VL / OCR)

图像分析、视频理解、OCR 文档提取。注:文本生成章节中的 qwen3.8/3.7/3.6/3.5 全系同样支持视觉输入(1M 上下文、最长 2 小时视频),VL 系列为视觉专用增强

模型 ID定位价格模态思考速度上下文最大输出特性说明
qwen3-vl-plus推荐 旗舰
深度 标准 256K 64k 视频 1 小时 视觉旗舰,¥1/¥10 起
qwen3-vl-flash 经济
标准 快速 256K 64k 视频 1 小时 轻量视觉版
qwen3.5-ocr 均衡
基础 标准 文档/表格/手写 OCR 专用,文字提取精度优化
qwen-vl-ocr 经济
快速 标准 旧版 OCR,建议迁移 qwen3.5-ocr
qvq-max 均衡
深度 较慢 视觉推理 旧版视觉推理,能力已并入 Qwen3-VL
qvq-plus 经济
标准 较慢 视觉推理 旧版视觉推理
qwen-vl-max 均衡
基础 标准 旧版 VL
qwen-vl-plus 经济
快速 快速 旧版 VL

图像生成模型

文生图与图片编辑;qwen-image-3.0 系列支持 agent prompt 智能改写与中文文字渲染

模型 ID定位价格文生图编辑最大输出最大分辨率说明
qwen-image-3.0-proNEW推荐 旗舰 支持 支持 6 2048x2048 图像 3.0 旗舰,agent prompt 改写,小字/多语言渲染
qwen-image-3.0NEW 均衡 支持 支持 6 2048x2048 同上,生成速度更快
wan2.7-image-proNEW 旗舰 支持 支持 4(连续12) 4096x4096 品牌色调色盘、多图参考(9 张)、角色一致性
wan2.7-imageNEW 均衡 支持 支持 4(连续12) 2048x2048 同上,生成速度更快
z-image-turbo 经济 支持 不支持 1 2048x2048 快 10 倍、价格约 1/5,写实人像/产品图
qwen-image-2.0-pro 均衡 支持 支持 6 2048x2048 上代专业版
qwen-image-2.0 均衡 支持 支持 6 2048x2048 上代标准版
qwen-image-max 均衡 支持 不支持 1 1664x928 旧版旗舰
qwen-image-plus 经济 支持 不支持 1 1664x928 旧版均衡
qwen-image-edit-max 均衡 不支持 支持 6 2048x2048 图片编辑专用
qwen-image-edit-plus 经济 不支持 支持 6 2048x2048 图片编辑轻量版
wan2.6-t2i 均衡 支持 支持 4 1440x1440 万相文生图
wan2.6-image 均衡 支持 支持 4 1440x1440 万相图像生成与编辑

视频生成模型(万相 / HappyHorse)

按输出视频秒数计费(输入不计费),部分模型按分辨率分档定价

模型 ID定位类型计费分辨率说明
wan3.0-video-primeNEW推荐 旗舰 文生视频 0.45-1.8元/秒 1080P 最新万相视频旗舰
wan3.0-videoNEW 旗舰 文生视频 0.3-1.2元/秒 1080P 限时 7 折
wan2.7-t2vNEW 旗舰 文生视频 0.6-1元/秒 1080P
wan2.7-i2vNEW 旗舰 图生视频(有声) 0.6-1元/秒 1080P
wan2.7-r2vNEW 旗舰 参考生视频(有声) 0.6-1元/秒 1080P
happyhorse-1.1-t2vNEW推荐 旗舰 文生视频 0.45-1.2元/秒 1080P 限时 6 折,最新第三方视频生成
happyhorse-1.1-i2vNEW 旗舰 图生视频 0.45-1.2元/秒 1080P 图片驱动视频
happyhorse-1.1-r2vNEW 旗舰 参考生视频 0.45-1.2元/秒 1080P 参考图/角色驱动
happyhorse-1.0-video-editNEW 旗舰 视频编辑 0.9-1.6元/秒 1080P 限时 8 折,输入+输出均计费
wan2.6-t2v 旗舰 文生视频 按秒计费 1080P 万相文生视频
wan2.6-i2v 旗舰 图生视频 按秒计费 1080P 万相图生视频
wan2.6-r2v 旗舰 参考生视频 按秒计费 1080P 万相参考生视频
wan2.2-t2v-plus 均衡 文生视频 按秒计费 1080P 上代专业版
wan2.2-i2v-plus 均衡 图生视频 按秒计费 1080P 上代专业版
wan2.2-kf2v-flash 均衡 首尾帧视频 按秒计费 720P 首帧+尾帧插值生成
wan2.2-s2v 均衡 声生视频 按秒计费 720P 音频驱动数字人/动画
wan2.2-animate-move 均衡 动作迁移 按秒计费 720P 将视频动作迁移到图片角色
wan2.2-animate-mix 均衡 角色替换 按秒计费 720P 视频中角色替换/混合
wanx2.1-t2v-turbo 经济 文生视频 按秒计费 720P 经济版
wanx2.1-i2v-turbo 经济 图生视频 按秒计费 720P 经济版
wanx2.1-kf2v-plus 经济 首尾帧视频 按秒计费 720P 经济版
wanx2.1-vace-plus 经济 视频编辑 按秒计费 720P 万相视频编辑

语音识别模型(ASR)

实时(WebSocket 流式)与非实时(HTTP 文件转写)两大路线;Qwen-Audio-3.0 系列支持热词与 Prompt 上下文注入

模型 ID定位模式API精度增强说话人分离时长/大小说明
qwen-audio-3.0-asr-flash-streamingNEW推荐 旗舰 实时 WebSocket 热词+Prompt 无限制 实时识别旗舰,多语种及方言
qwen-audio-3.0-asr-flash-filetransNEW推荐 旗舰 非实时 HTTP 热词+Prompt 支持 12小时/2GB 文件转写旗舰,支持说话人分离
qwen-audio-3.0-asr-flashNEW 均衡 非实时 HTTP 热词+Prompt 5分钟/2GB 短音频快速转写
fun-asr-realtime 均衡 实时 WebSocket 热词 无限制 FunASR 实时版
fun-asr-mtl-realtime 均衡 实时 WebSocket 热词 无限制 FunASR 多语种实时版
fun-asr 均衡 非实时 HTTP 热词 支持 12小时/2GB FunASR 文件版,支持说话人分离
fun-asr-mtl 均衡 非实时 HTTP 热词 支持 12小时/2GB FunASR 多语种版
qwen3-asr-flash-realtime 均衡 实时 WebSocket 无限制 支持情感识别
qwen3-asr-flash-filetrans 均衡 非实时 HTTP 12小时/2GB 支持情感识别
qwen3-asr-flash 经济 非实时 HTTP(OpenAI兼容) 5分钟/10MB 支持情感识别
paraformer-realtime-v2 经济 实时 WebSocket 旧版,建议迁移 Fun-ASR / Qwen-ASR
paraformer-v2 经济 非实时 HTTP 支持 旧版
sensevoice-v1弃用 经济 非实时 HTTP 即将下线,尽快迁移
gummy-realtime-v1弃用 经济 实时 WebSocket 即将下线,尽快迁移
gummy-chat-v1弃用 经济 实时 WebSocket 1分钟 即将下线,尽快迁移

语音合成模型(TTS)

标准合成 / 声音复刻(音频样本克隆)/ 声音设计(文字描述创建);指令控制可用自然语言调整语气、情绪、语速

模型 ID定位价格系列API声音复刻声音设计指令控制说明
qwen-audio-3.0-tts-plusNEW推荐 旗舰 Qwen-Audio-TTS WS / HTTP 支持 支持 支持 最新 TTS 旗舰,全能力
qwen-audio-3.0-tts-flashNEW 均衡 Qwen-Audio-TTS WS / HTTP 支持 支持 支持 轻量版
cosyvoice-v3.5-plus 旗舰 CosyVoice WS / HTTP 支持 支持 支持 支持 SSML 与 LaTeX 公式朗读
cosyvoice-v3.5-flash 均衡 CosyVoice WS / HTTP 支持 支持 支持 轻量版
cosyvoice-v3-flash 经济 CosyVoice WS / HTTP 支持 支持 支持 轻量版,1元/万字符
cosyvoice-v3-plus 均衡 CosyVoice WS / HTTP 支持 支持 上代专业版
MiniMax/speech-2.8-hd 均衡 MiniMax HTTP 支持 第三方高保真音色
qwen3-tts-flash 经济 Qwen3-TTS HTTP 标准合成经济版
qwen3-tts-instruct-flash 经济 Qwen3-TTS HTTP 支持 指令控制语气/情绪/风格
qwen3-tts-vc 均衡 Qwen3-TTS-VC WS / HTTP 支持 声音复刻专用
qwen3-tts-vd 均衡 Qwen3-TTS-VD WS / HTTP 支持 声音设计专用
qwen-tts 经济 Qwen-TTS(旧版) HTTP / WS 按 Token 计费旧版,建议迁移 Qwen3-TTS
qwen-voice-enrollment 均衡 0.01元/音色 音色管理 音色注册与管理(声音复刻前置)
qwen-voice-design 均衡 0.2元/音色 声音设计服务 文字描述创建新音色,按个计费

向量与重排序模型

语义搜索、RAG 检索与精度提升;重排序建议在 Embedding 检索后对 Top-N 结果二次排序

模型 ID定位价格类型向量维度最大 Token说明
text-embedding-v4推荐 旗舰 文本 Embedding 64~2048 8,192 最新文本向量,维度兼容 v3,MTEB 领先
qwen3.7-text-embeddingNEW 旗舰 文本 Embedding 64~2048 8,192 新一代文本向量(Qwen3.7 代),¥0.5
text-embedding-v3 经济 文本 Embedding 512~1024 8,192 已有 v3 索引迁移
qwen3-vl-embedding 均衡 多模态 Embedding 256~2560 32,000 图文混合检索(融合+独立向量)
qwen2.5-vl-embedding 均衡 多模态 Embedding 512~2048 32,000 图文混合检索(仅融合向量)
tongyi-embedding-vision-plus 均衡 多模态 Embedding 64~1152 1,024 跨模态搜索(独立向量)
tongyi-embedding-vision-flash 经济 多模态 Embedding 64~768 1,024 低成本跨模态
qwen3-rerank推荐 旗舰 重排序 4,000/条 100+ 语言,最多 500 文档
qwen3-vl-rerank 均衡 多模态重排序 8,000/条 文本/图片/视频混合排序
gte-rerank-v2 经济 重排序 4,000/条 文本语义检索

专用模型

翻译、文档解析、深度研究与文本分析等垂直场景专用模型

模型 ID定位价格用途说明
qwen-mt-plus 均衡 机器翻译 多语言互译专用,支持术语注入
qwen-doc-turbo 均衡 文档解析 文档内容提取与结构化
qwen-deep-research 旗舰 深度研究 联网检索 + 多步推理 + 长文报告,¥54/¥163
tongyi-xiaomi-analysis-pro 均衡 对话分析 通义晓蜜专业版,¥1.0/¥2.7
tongyi-xiaomi-analysis-flash 经济 对话分析 通义晓蜜轻量版,¥0.2/¥0.4
qwen-math-plus 旗舰 数学推理 数学/竞赛题求解专用,¥4/¥12
qwen-math-turbo 均衡 数学推理 数学推理轻量版,¥2/¥6
qwen-mt-flash 经济 机器翻译 轻量版,¥0.7/¥1.95
qwen-mt-lite 经济 机器翻译 经济版,¥0.6/¥1.6
qwen-mt-turbo 经济 机器翻译 速度优化版,¥0.7/¥1.95
qwen-mt-image-2.0 均衡 图像翻译 图片中文字翻译为多国语言,0.004元/张
fun-music-v1 经济 0.002元/秒 音乐生成 按歌词/提示词生成音乐,按秒计费

开源模型(可私有化部署)

开源权重,可自行部署,无 API 调用限制,仅需硬件成本;百炼同时提供开源版托管调用

模型 ID定位价格思考上下文说明
qwen3.8-2.4t-a95bNEW开源 旗舰 自托管 最强 最新开源旗舰,混合思考默认开启
qwen3.6-35b-a3b开源 均衡 自托管 深度 256K 开源均衡版(MoE 35B-A3B)
qwen3.6-27b开源 均衡 深度 开源稠密 27B(Qwen3.6 代),¥3/¥18
qwen3.5-397b-a17b开源 旗舰 自托管 深度 32K 开源旗舰(MoE 397B-A17B)
qwen3.5-122b-a10b开源 均衡 自托管 标准 32K 开源中杯(MoE 122B-A10B)
qwen3.5-35b-a3b开源 经济 自托管 标准 32K 开源小杯(MoE 35B-A3B)
qwen3.5-27b开源 经济 自托管 标准 32K 开源稠密版 27B
qwen3-next-80b-a3b-instruct开源 旗舰 快速 256K Qwen3-Next 新一代开源 MoE 80B-A3B,¥1/¥4
qwen3-next-80b-a3b-thinking开源 旗舰 深度 256K Qwen3-Next 思考版(仅思考),¥1/¥10
qwen3-coder-next开源 旗舰 快速 256K 开源编程新版,¥1/¥4
qwen3-235b-a22b-instruct-2507开源 旗舰 快速 256K Qwen3 开源旗舰 MoE 235B-A22B
qwen3-235b-a22b-thinking-2507开源 旗舰 深度 256K Qwen3 开源思考旗舰,¥2/¥20
qwen3-vl-235b-a22b-instruct开源 旗舰 快速 256K 开源视觉旗舰 MoE 235B-A22B
qwen3-vl-235b-a22b-thinking开源 旗舰 深度 256K 开源视觉思考旗舰
qwen3-omni-30b-a3b-captioner开源 均衡 快速 开源全模态视频字幕/描述

旧版与即将下线模型

以下为本页已收录模型中的旧版/下线信息,请按建议迁移,勿在新项目中使用。数据来源:阿里云百炼官方文档(2026-08-30 同步)

模型 ID生命周期替代方案迁移建议
sensevoice-v1弃用 Deprecated fun-asr 即将下线,尽快迁移 Fun-ASR / Qwen-ASR
gummy-realtime-v1弃用 Deprecated fun-asr-realtime 即将下线,尽快迁移
gummy-chat-v1弃用 Deprecated fun-asr-realtime 即将下线,尽快迁移
qwen-omni-turbo Legacy qwen3.5-omni-plus 旧版全模态,能力已全面升级
qwen-tts Legacy qwen3-tts-flash / qwen-audio-3.0-tts-plus 按 Token 计费旧版 TTS
paraformer-realtime-v2 Legacy fun-asr-realtime / qwen3-asr-flash-realtime 旧代 ASR,建议迁移
paraformer-v2 Legacy fun-asr / qwen3-asr-flash-filetrans 旧代 ASR
qwen-vl-ocr Legacy qwen3.5-ocr 旧版 OCR
qvq-max Legacy qwen3-vl-plus 视觉推理能力已并入 Qwen3-VL
qvq-plus Legacy qwen3-vl-flash 旧版视觉推理
qwen-vl-max Legacy qwen3-vl-plus 旧版 VL
qwen-vl-plus Legacy qwen3-vl-flash 旧版 VL

能力矩阵速查

根据需求快速匹配最佳模型

需求场景推荐模型备选模型关键能力
日常对话 / 写作 qwen3.7-plus qwen3.6-plus 深度 + 1M 上下文
深度思考 / 推理 qwen3.8-max qwq-plus 最强 混合思考
最强旗舰 qwen3.8-max-prime qwen3.8-max ¥24/¥72 优速模式
极致低成本 qwen3.7-flash qwen3.8-flash ¥0.2/¥0.8
Agentic 编程工作流 qwen3-coder-plus qwen3.7-plus + 1M 上下文
超长文档处理千万字级 qwen-long qwen3.7-plus 10M 上下文
图像 / 视频理解 qwen3-vl-plus qwen3.7-plus 2 小时视频 · 1M 上下文
全模态理解(图+音+视) qwen3.5-omni-plus qwen3-omni-flash
实时语音对话 qwen-audio-3.0-realtime-plus qwen3.5-omni-plus-realtime 语义 VAD + WebSocket
语音听录 / 转写 qwen-audio-3.0-asr-flash-filetrans fun-asr 12 小时 + 说话人分离
语音合成 qwen-audio-3.0-tts-plus cosyvoice-v3.5-plus 复刻 / 设计 / 指令控制
实时语音翻译 qwen3.5-livetranslate-flash-realtime qwen3-livetranslate-flash-realtime 60 语言 · 3 秒延迟
高质量图像生成 qwen-image-3.0-pro wan2.7-image-pro 2048x2048 / 4096x4096
视频生成 happyhorse-1.1-t2v wan2.6-t2v 1080P · 按秒计费
语义搜索 / RAG text-embedding-v4 qwen3-vl-embedding 2048 维 + qwen3-rerank
私有化部署 qwen3.8-2.4t-a95b qwen3.6-35b-a3b 开源权重