Qwen3.8-Flash-Next

Qwen3.8-Flash-Next

阿里通义千问开源的 Qwen4 架构先导预览版,多模态 MoE 总参125B、每 token 仅激活6B,原生支持262144 token上下文,以极致性价比服务编程与 Agent 场景。

月访问量
0
累计浏览
1
用户评分
4.6
收录时间
2026-08

产品介绍

产品介绍

Qwen3.8-Flash-Next 是阿里巴巴通义千问团队 2026 年 8 月 26 日发布并开源的多模态 MoE 模型,官方定位为下一代 Qwen4 架构的实验性预览版。语言模型主参 125B,额外配备 51B 的 N-gram Embedding 与 4B 的 MTP,每 token 仅激活约 6B 参数,原生支持 262,144 tokens 上下文并可通过 YaRN 进一步扩展。

核心功能

  • 多模态 MoE:125B 总参 / 6B 激活,创下模型效率全球新基准
  • Qwen4 架构雏形:下一代全新架构的先导预览版
  • 262,144 token 原生上下文:支持 YaRN 长上下文扩展
  • 极致性价比:编程、Agent 等真实任务中极具成本优势
  • 完全开源:权重与 FP8 量化版同步上架 Hugging Face 与 ModelScope

开源与部署

模型开放权重可本地部署,社区已提供 SGLang、vLLM 等推理引擎的 day-0 部署方案,开发者可直接拉取使用。

定位

作为 Qwen4 先导预览,主打“拼效率”路线,以 6B 激活实现以往更大参数的智能水平,帮助开发者和中小企业以更低成本获得前沿能力。