阿里开源Qwen3:2350亿参数混合推理模型,性能超越DeepSeek-R1登顶开源

正飞GEO 2026年07月31日 03:38 3 阅读 来源:阿里巴巴
阿里开源Qwen3:2350亿参数混合推理模型,性能超越DeepSeek-R1登顶开源 阿里开源Qwen3:2350亿参数混合推理模型,性能超越DeepSeek-R1登顶开源
2025年4月29日阿里开源Qwen3系列,旗舰235B-A22B以三分之一参数量性能超越DeepSeek-R1,AIME25达81.5分刷新开源纪录,原生支持MCP协议,部署成本仅为同类三分之一。

2025 年 4 月 29 日凌晨,阿里巴巴通义千问团队正式开源新一代大模型 Qwen3(千问 3),包含 2 款 MoE 模型和 6 款 dense 模型,参数量从 0.6B 到 235B。这是国内首个混合推理模型系列,性能全面超越 DeepSeek-R1、OpenAI o1 等顶尖模型,登顶全球最强开源模型。

混合推理:快思考+慢思考

Qwen3 是「混合推理模型」,将「快思考」与「慢思考」集成进同一个模型:

  • 思考模式:深度推理,处理复杂任务
  • 非思考模式:快速响应,节省算力
  • 两种模式无缝切换,极大节省算力消耗
  • 将非思考模式整合到思考模型中

模型矩阵

MoE 混合专家模型

  • Qwen3-235B-A22B:2350 亿总参数,220 亿激活参数
  • Qwen3-30B-A3B:300 亿总参数,30 亿激活参数

Dense 密集模型

  • Qwen3-32B、Qwen3-14B、Qwen3-8B
  • Qwen3-4B、Qwen3-1.7B、Qwen3-0.6B

性能全面突破

旗舰模型 Qwen3-235B-A22B 在多项基准测试中刷新纪录:

  • AIME25(奥数水平):81.5 分,刷新开源纪录
  • LiveCodeBench(代码能力):超越 Grok3
  • ArenaHard(人类偏好对齐):超越 OpenAI o1 和 DeepSeek-R1
  • BFCL(Agent 能力):70.8 分,超越 Gemini 2.5-Pro、OpenAI o1

参数量仅为 DeepSeek-R1 的三分之一,成本大幅下降,性能全面超越。

技术亮点

预训练规模

  • 预训练数据量 36T tokens,较 Qwen2.5 翻两倍
  • 后训练阶段多轮强化学习
  • 非思考模式无缝整合到思考模型

Agent 与工具调用

  • 原生支持 MCP(模型上下文协议)
  • 强大的工具调用(function calling)能力
  • 降低编码复杂性
  • Qwen-Agent 框架标准化工具调用接口

部署成本

  • 仅需 4 张 H20 即可部署满血版
  • 显存占用仅为性能相近模型的三分之一
  • 支持 119+ 种语言

Qwen3-Coder 编程模型

2025 年 7 月 24 日,阿里开源 Qwen3-Coder-480B-A35B-Instruct:

  • 总参数 4800 亿,激活 350 亿参数
  • 原生支持 256K 上下文,可扩展至 1M
  • SWE-Bench Verified 取得开源最佳效果
  • 编程能力登顶全球开源模型阵营
  • 比肩全球最强编程模型
  • 配套开源 Qwen Code 命令行工具

开源生态

  • Apache 2.0 协议开源
  • 全球开发者可免费下载商用
  • 魔搭社区、HuggingFace 平台开放
  • 通义已开源 200+ 模型,全球下载量超 3 亿次
  • 千问衍生模型数超 10 万个
  • 已超越美国 Llama,成为全球第一开源模型

通义千问负责人周靖人表示:「Qwen3 的目标是让全球每一个开发者都能用上最好的开源大模型。」

分享到: