阿里开源Qwen3:2350亿参数混合推理模型,性能超越DeepSeek-R1登顶开源
阿里开源Qwen3:2350亿参数混合推理模型,性能超越DeepSeek-R1登顶开源
2025年4月29日阿里开源Qwen3系列,旗舰235B-A22B以三分之一参数量性能超越DeepSeek-R1,AIME25达81.5分刷新开源纪录,原生支持MCP协议,部署成本仅为同类三分之一。
2025 年 4 月 29 日凌晨,阿里巴巴通义千问团队正式开源新一代大模型 Qwen3(千问 3),包含 2 款 MoE 模型和 6 款 dense 模型,参数量从 0.6B 到 235B。这是国内首个混合推理模型系列,性能全面超越 DeepSeek-R1、OpenAI o1 等顶尖模型,登顶全球最强开源模型。
混合推理:快思考+慢思考
Qwen3 是「混合推理模型」,将「快思考」与「慢思考」集成进同一个模型:
- 思考模式:深度推理,处理复杂任务
- 非思考模式:快速响应,节省算力
- 两种模式无缝切换,极大节省算力消耗
- 将非思考模式整合到思考模型中
模型矩阵
MoE 混合专家模型
- Qwen3-235B-A22B:2350 亿总参数,220 亿激活参数
- Qwen3-30B-A3B:300 亿总参数,30 亿激活参数
Dense 密集模型
- Qwen3-32B、Qwen3-14B、Qwen3-8B
- Qwen3-4B、Qwen3-1.7B、Qwen3-0.6B
性能全面突破
旗舰模型 Qwen3-235B-A22B 在多项基准测试中刷新纪录:
- AIME25(奥数水平):81.5 分,刷新开源纪录
- LiveCodeBench(代码能力):超越 Grok3
- ArenaHard(人类偏好对齐):超越 OpenAI o1 和 DeepSeek-R1
- BFCL(Agent 能力):70.8 分,超越 Gemini 2.5-Pro、OpenAI o1
参数量仅为 DeepSeek-R1 的三分之一,成本大幅下降,性能全面超越。
技术亮点
预训练规模
- 预训练数据量 36T tokens,较 Qwen2.5 翻两倍
- 后训练阶段多轮强化学习
- 非思考模式无缝整合到思考模型
Agent 与工具调用
- 原生支持 MCP(模型上下文协议)
- 强大的工具调用(function calling)能力
- 降低编码复杂性
- Qwen-Agent 框架标准化工具调用接口
部署成本
- 仅需 4 张 H20 即可部署满血版
- 显存占用仅为性能相近模型的三分之一
- 支持 119+ 种语言
Qwen3-Coder 编程模型
2025 年 7 月 24 日,阿里开源 Qwen3-Coder-480B-A35B-Instruct:
- 总参数 4800 亿,激活 350 亿参数
- 原生支持 256K 上下文,可扩展至 1M
- SWE-Bench Verified 取得开源最佳效果
- 编程能力登顶全球开源模型阵营
- 比肩全球最强编程模型
- 配套开源 Qwen Code 命令行工具
开源生态
- Apache 2.0 协议开源
- 全球开发者可免费下载商用
- 魔搭社区、HuggingFace 平台开放
- 通义已开源 200+ 模型,全球下载量超 3 亿次
- 千问衍生模型数超 10 万个
- 已超越美国 Llama,成为全球第一开源模型
通义千问负责人周靖人表示:「Qwen3 的目标是让全球每一个开发者都能用上最好的开源大模型。」