Qwen3(通义千问)

Qwen3 是阿里云通义千问团队的开源大模型系列,2025 年 5 月正式发布全系列,2026 年 8 月再次更新 Qwen3.8 系列(含 27B / Max 等规格)。Qwen3 是当前最强、覆盖规格最全的开源模型家族之一,从 0.6B 端侧到 235B / Max 云端一次性开放,Apache 2.0 协议全栈开源,并提供 /think 思考模式开关。


一、公司速览

阿里云通义千问

  • 团队归属:阿里巴巴集团 · 阿里云
  • 品牌:通义千问 / Qwen / Tongyi Qianwen
  • 官网:qwen.alibaba.com / tongyi.aliyun.com
  • 定位:阿里自研通用大模型系列,主打开源 + 全规格
  • 国际品牌:Qwen(海外开发者熟悉度最高的中国模型之一)

核心方向

  • 全规格开源:从 0.6B 端侧模型到 235B / Max 云端模型,覆盖所有部署场景
  • Apache 2.0 协议:最宽松的开源协议之一
  • 多模态全栈:文本、视觉、音频、代码、数学模型都有
  • 国际开发者友好:Hugging Face + ModelScope 双发布,文档英文优先

二、产品矩阵

模型层(Qwen3 系列)

Qwen3 系列在 2025 年 5 月一次性发布完整矩阵,2026 年 8 月升级到 Qwen3.8 系列。

Qwen3 通用语言模型

模型参数定位
Qwen3-0.6B0.6B端侧 / 嵌入式
Qwen3-1.7B1.7B端侧 / 轻量
Qwen3-4B4B边缘 / 低资源
Qwen3-8B8B单卡可跑
Qwen3-14B14B中等规模
Qwen3-32B32B高质量
Qwen3-235B235B(激活 22B)旗舰 MoE
Qwen3-Max未公开(推测 > 1T)顶级旗舰 来源

Qwen3.8 系列(2026-08 最新)

  • Qwen3.8-27B:性能与成本的黄金平衡点 来源
  • Qwen3.8-Max:首次开源 Max 级模型,下周权重上线 Hugging Face + ModelScope 来源

衍生模型

  • Qwen3-VL:视觉语言模型
  • Qwen3-Coder:代码专精模型
  • QwQ:推理专精模型(思考模式)
  • QVQ:视觉推理模型

产品层

产品定位
通义千问 AppC 端对话产品
阿里云百炼平台B 端 API(兼容 OpenAI 协议)来源
ModelScope国内开源社区
Hugging Face海外开源发布

三、Qwen3 核心特性

3.1 全规格覆盖(业内最全)

Qwen3 是当前覆盖规格最全的开源模型家族——从 0.6B 端侧到 235B MoE 旗舰一次性发布 来源。

场景推荐规格
手机 / 嵌入式0.6B - 4B
笔记本 / 单卡8B - 14B
工作站32B - 72B
数据中心235B / Max

3.2 双 MoE 模型「越级挑战」

Qwen3 系列有 两个 MoE 模型(30B-A3B / 235B-A22B),激活参数远小于总参数,实际推理成本接近小模型,能力却对标大模型来源。

这是 Qwen3 最重要的差异化之一——让中小企业也能跑得起大模型。

3.3 /think 思考模式开关

Qwen3 系列提供 /think 思考模式开关——一个模型既是普通对话模型,又能切换成深度思考模式 来源。

  • /think 模式:进入深度推理,类似 OpenAI o1
  • 非 /think 模式:常规快速对话,类似 GPT-4o

这是 Qwen3 独有的差异化——其他模型家族没有这种开关。

3.4 Apache 2.0 协议

Qwen3 全系列采用 Apache 2.0 协议——最宽松的开源协议之一 来源。

协议商用修改分发私有使用
Apache 2.0✅✅✅✅
限制需要保留版权声明和许可证副本

比 MIT 略严格,但仍然非常宽松。

3.5 多语言能力

Qwen3 在多语言支持上是国产模型最强的——支持 119 种语言,远超其他国产模型 来源。


四、能力评测

4.1 主要榜单

Qwen3 在多个国际权威榜单上取得 全球开源冠军、国产模型冠军来源:

榜单Qwen3 表现
LiveBench全球开源冠军
LiveCodeBench全球开源冠军
SuperClue国产模型冠军
Artificial Analysis全球开源冠军

4.2 Qwen3.8-Max 价格优势

国际价格:$2.0/百万输入 / $6.0/百万输出——约为 Claude Opus 5 的 40% 与 24% 来源。

国内价格:缓存命中输入只要 1.5 元/百万 tokens。

意义:Qwen3.8-Max 是当前顶级旗舰里价格最低的之一。

4.3 与国内主流模型对比

模型公司上下文开源价格思考模式
Qwen3-Max阿里长✅ Apache 2.0最低✅
M3MiniMax1M✅中等❌
GLM-5.3智谱中长✅ MIT中等❌
Kimi K3月之暗面4M✅较高❌
DeepSeek V4DeepSeek1M✅ MIT低❌

Qwen3 的独特优势:唯一开源 + Apache 2.0 + 全规格 + /think 开关 + 最低价的旗舰组合。


五、技术亮点

5.1 MoE 架构创新

Qwen3 的两个 MoE 模型(30B-A3B / 235B-A22B):

  • 激活参数仅 3B / 22B——单次推理算力可控
  • 总参数 30B / 235B——能力对标大模型
  • 推理成本接近 3B / 22B 密集模型

5.2 /think 切换机制

Qwen3 的 /think 模式不是简单的 prompt 拼接,而是模型内部做了专门的训练优化:

  • 训练数据中包含思考过程
  • 推理时通过特殊 token 触发
  • 比 OpenAI o1 的 API 调用方式更灵活(用户可自由切换)

5.3 Qwen3.8 新特性(2026-08)

  • 性能与成本平衡:27B 是「黄金平衡点」来源
  • 首次开源 Max 级:千问史上首次把 Max 级模型开源 来源
  • 多语言扩展:119 种语言

六、商业策略

6.1 价格策略

  • 国际:$2.0 输入 / $6.0 输出(百万 token)
  • 国内:1.5 元/百万输入(缓存命中)
  • 对标 Claude Opus 5:40% 与 24% 来源
  • 对标国内:低于 DeepSeek V4(DeepSeek 走极致低价路线)

6.2 双渠道分发

渠道用户
Hugging Face海外开发者
ModelScope国内开发者
阿里云百炼企业 API 用户

6.3 开源 + 商业双轨

  • 开源:Apache 2.0 全规格权重
  • 商业:阿里云 API 调用、企业级 SLA、专属支持

七、国内大模型横向对标

模型公司上下文开源协议价格旗舰规格思考模式
Qwen3-Max阿里长Apache 2.0最低顶级✅
M3MiniMax1M开源中等顶级❌
GLM-5.3智谱中长MIT中等顶级❌
Kimi K3月之暗面4M自定义较高顶级❌
DeepSeek V4DeepSeek1MMIT低顶级❌

Qwen3 的独特卖点:

  • Apache 2.0 协议最宽松
  • 全规格覆盖(0.6B 到 Max)
  • /think 开关独家
  • 价格最低
  • 多语言 119 种

八、适合什么样的使用者

推荐用 Qwen3 的场景

  • ✅ 本地私有部署:Apache 2.0 最自由
  • ✅ 需要 100+ 语言支持:Qwen3 多语言最强
  • ✅ 端侧 AI 应用:0.6B / 1.7B 嵌入式友好
  • ✅ 成本敏感应用:价格最低
  • ✅ 需要 /think 切换:思考模式灵活
  • ✅ 企业多场景部署:全规格覆盖

不太推荐用 Qwen3 的场景

  • ❌ 需要 1M+ 超长上下文:Kimi K3 的 4M 更大
  • ❌ 极致安全研究:GLM-5.3 在 ExploitGym 领先
  • ❌ 顶级代码生成 + 长上下文:M3 / K3 在 Frontend Arena 略胜

九、常见问题

Q1:Qwen3 和 Qwen2.5 怎么选?

  • Qwen3:当前最新版,全新架构
  • Qwen2.5:上一代,性能略低但稳定
  • 全新项目推荐 Qwen3

Q2:Qwen3-Max 和 Qwen3-235B 怎么选?

  • Max:顶级旗舰,能力最强,价格也是 Qwen3 家族最高
  • 235B:次旗舰 MoE,激活 22B,性价比突出
  • 预算充足选 Max,预算敏感选 235B

Q3:Qwen3 的 /think 模式怎么用?

通过 prompt 中的特殊标记开启。例如在 system prompt 中加入 /think 触发深度推理,或在用户消息中明确要求”先思考再回答”。

Q4:Qwen3 商用需要付费吗?

不需要。Apache 2.0 协议允许商用,但需要保留版权声明和许可证副本。

但如果你用阿里云 API(百炼平台),那是按调用付费的——和开源不冲突。

Q5:Qwen3 在国内合规吗?

是的。Qwen3 通过国内备案,可在阿里云百炼平台合规调用 来源。


十、延伸阅读

官方资源

第三方分析

相关笔记


十一、一句话总结

Qwen3 是 2026 年中国开源大模型里”全规格 + 全协议 + 全语言”维度的标杆——0.6B 到 Max 全栈、Apache 2.0 最宽松协议、119 种语言、/think 思考开关、顶级旗舰里最低价格。如果你需要本地私有部署、多语言支持、全场景覆盖、最宽松商用协议,Qwen3 是当前最值得认真考虑的国产开源模型家族。

Coding Plan(AI 编码套餐)

阿里云百炼的 Coding Plan 是固定月费的 AI 编码套餐,整合千问、GLM、Kimi、MiniMax 等模型,兼容 Qwen Code、Claude Code、Cline、OpenClaw 等主流 AI 编程工具(2026-09 官方文档)。

  • 固定月费、月度请求额度,成本可控,无按量扣费风险
  • 必须使用 Coding Plan 专属 Base URL 和 API Key(编程端点为 coding.dashscope.aliyuncs.com 下的 Anthropic 协议地址);专属 Key 配标准端点会报「invalid access token or token expired」

来源:Coding Plan 概述(阿里云帮助中心)