阿里2.4万亿参数Qwen3.8-Max下周开源,旗舰模型首次打破闭源惯例
阿里2.4万亿参数Qwen3.8-Max下周开源,旗舰模型首次打破闭源惯例
阿里巴巴8月3日发布新一代基座大模型Qwen3.8-Max,总参数2.4万亿采用MoE架构,激活参数950亿,支持100万Token上下文。官方宣布下周开源模型权重,这是Qwen-Max级别旗舰模型首次对外开放,打破最强模型必须闭源的行业惯例。
8月4日下午消息,继Kimi K3之后,阿里巴巴于当地时间8月3日发布新一代基座大模型Qwen3.8-Max。该模型总参数量达到2.4万亿,采用稀疏混合专家(MoE)架构,单次推理仅激活约950亿参数,兼顾旗舰级模型容量与极低推理延迟。最引人注目的是,阿里官方宣布Qwen3.8-Max模型权重预计将于下周正式开源公布,这是Qwen-Max级别旗舰模型首次对外开源。
模型核心能力
Qwen3.8-Max的技术指标标志着国产大模型进入全球第一梯队:
- 参数规模:总参数2.4万亿,单次激活950亿参数,MoE架构实现效率与能力的平衡
- 上下文窗口:支持最长100万Token上下文窗口,原生具备多模态视觉能力
- 性能表现:官方宣称在编程、办公、科学研究及长周期任务中的综合表现已进入全球大模型第一梯队
- 推理成本:每百万输出Token成本约6美元,仅为Fable 5等标杆模型50美元成本的约1/8
战略转向开源
此次Max级别旗舰模型开源是阿里AI商业策略的重大转变:
- 打破闭源惯例:Qwen系列自2023年推出以来有多款开源模型,但Max系列作为定位最高的闭源旗舰,此前仅支持API调用,用户无法下载权重
- 应对开源冲击:DeepSeek V4 Flash以极致性价比引发全球开发者大规模迁移后,开源策略已被证明能够独立切开市场空间,死守闭源API利润前景面临挑战
- 争夺生态话语权:通过开源降低采用门槛、扩大海外覆盖、促进跨多云和异构硬件部署,在未来AI Agent生态中争夺标准制定权
全栈算力优势
蔡崇信在此前访谈中将AI开源企业分为两类:纯模型公司变现面临本质挑战,而阿里这类全栈科技企业可通过云服务获利。阿里的差异化优势在于软硬件协同:
- 旗下平头哥实现从AI芯片到CPU、网卡、存储主控的全自研
- 7月阿里云灵骏真武M890超节点实例成功适配Qwen3.8,系国内首个成功运行超2万亿参数大模型的超节点
- 配套千问办公Agent产品同步上线,形成从模型到应用的全栈布局
业界分析认为,Qwen3.8-Max开源标志着国产模型的合围之势:Qwen提供高可控、强视觉、长上下文的多模态Agent基座,DeepSeek提供极低算力消耗的推理层,中国开源模型正在引导全球中小企业将AI基建全面转向开源生态。