Qwen开源模型全家桶选购指南(3.5/3.6/3.8全系列)

Qwen开源模型全家桶选购指南(3.5/3.6/3.8全系列)


从0.8B到397B全覆盖,编程/视觉/推理/端侧一张表选对模型

阿里 Qwen 开源模型全家桶选购指南(2026.08)

Qwen 从 3.5 开始统一了文本和视觉架构,模型命名不再有“-VL”后缀——所有模型都原生支持图像和视频。从 0.8B 到 397B,从 Dense 到 MoE,本地部署到 API 调用全覆盖。一张表选对模型。

版本演进时间线

2025.06  Qwen3 系列(文本与VL分开两条线)
2026.02  Qwen3.5(统一多模态架构,原生Agent,Gated DeltaNet+MoE)
2026.04  Qwen3.6(编程专精升级:SWE-bench超自家397B旗舰)
2026.05  Qwen3.7-Max(闭源 API only)
2026.08  Qwen3.8(混合线性注意力,最新开源旗舰)
2026.08  Qwen3.8-Max(2.4T MoE,闭源API旗舰)

全部开源模型一览

Qwen3.5 系列(2026.02-03)

模型架构激活参数上下文许可定位
Qwen3.5-0.8BDense0.8B256KApache 2.0端侧极速
Qwen3.5-2BDense2B256KApache 2.0轻量通用
Qwen3.5-4BDense4B256KApache 2.0低资源部署
Qwen3.5-9BDense9B256KApache 2.0性价比甜点
Qwen3.5-27BDense27B256KApache 2.0单卡旗舰
Qwen3.5-35B-A3BMoE3B256KApache 2.0MoE 甜点
Qwen3.5-122B-A10BMoE10B256KApache 2.0MoE 旗舰
Qwen3.5-397B-A17BMoE17B256KApache 2.0开源最强

Qwen3.6 系列(2026.04)

模型架构激活参数上下文许可定位
Qwen3.6-27BDense27B262K(1M)Apache 2.0编程最强 Dense
Qwen3.6-35B-A3BMoE3B262K(1M)Apache 2.0编程最强 MoE

Qwen3.8 系列(2026.08)

模型架构激活参数上下文许可定位
Qwen3.8-27BDense27B262K(1M)Apache 2.0最新开源旗舰
Qwen3.8-MaxMoE 2.4T~95B1M闭源 APIAPI 旗舰

闭源 API 系列

模型上下文说明
Qwen3.6-Plus256K云端优化
Qwen3.7-Max1M2026.05 发布
Qwen3.8-Max1M当前最强,$2/$6 per M tokens

核心场景选型

编程 / Agent

模型SWE-bench VerifiedTerminal-Bench 2.0显存(4bit)
Qwen3.8-27B85.990.0~16GB
Qwen3.6-27B77.259.3~16GB
Qwen3.6-35B-A3B76.4—~16GB
Qwen3.5-27B70.047.4~16GB
Qwen3.5-397B-A17B76.452.5多卡

结论:编程选 Qwen3.8-27B 或 Qwen3.6-35B-A3B(MoE更快)

视觉 / 视频理解

模型Video-MME(w/o sub)VideoMMMUOCRBench
Qwen3.5-122B-A10B83.9——
Qwen3.6-35B-A3B82.583.7—
Qwen3.8-27B82.8——
Qwen3.5-27B———

结论:视频理解选 Qwen3.5-122B-A10B(最强)或 Qwen3.6-35B-A3B(性价比)

数学 / 推理

模型AIME 2026GPQA DiamondMMLU-Pro
Qwen3.5-397B-A17B91.378.0—
Qwen3.6-35B-A3B—86.085.2
Qwen3.8-27B———
Qwen3.5-9B—81.775.6

结论:推理选 Qwen3.6-35B-A3B(性价比)或 Qwen3.5-397B-A17B(最强)

端侧 / 低资源

模型显存(4bit)适合
Qwen3.5-0.8B~0.5GB手机/嵌入式
Qwen3.5-4B~3GB树莓派/旧显卡
Qwen3.5-9B~6GB消费级 GPU

结论:9B 是小模型甜点,多项 benchmark 超越 120B 级闭源模型

Dense vs MoE 怎么选

Dense(如 27B)MoE(如 35B-A3B)
每个token全部参数参与只激活部分专家
实际推理成本等于总参数等于激活参数
显存占用较小(模型文件小)较大(所有专家都加载)
微调难度简单复杂(路由+专家)
量化效果好一般
适合场景显存紧张、微调带宽受限、推理速度优先

16GB 显存选 Dense 27B;带宽受限/追求速度选 MoE 35B-A3B

本地部署推荐

显存推荐模型用途
8GBQwen3.5-9B 4bit日常对话+看图
16GBQwen3.8-27B 4bit编程+多模态旗舰
24GBQwen3.5-27B 8bit高质量 Dense
48GBQwen3.5-122B-A10B 4bit接近旗舰级
2×24GBQwen3.5-397B-A17B 4bit开源最强

链接


一句话点评:Qwen 开源全家桶从 0.8B 到 397B 全覆盖,编程场景直接选 Qwen3.8-27B 或 Qwen3.6-35B-A3B,不会再纠结。小模型 9B 甜点惊人,大模型 397B 逼近闭源旗舰。

26100举报0子龙•1个月前
点击获取 ^_^
被收录:

暂无评论