Qwen3.8-Flash

Qwen3.8-Flash

阿里通义千问开源的极致性价比多模态MoE大模型,125B主模型每Token仅激活6B,原生支持262K上下文,办公与编码性能出色,8月起价格大幅下调。

月访问量
0
累计浏览
1
用户评分
4.5
收录时间
2026-08

产品介绍

阿里通义千问推出的多模态 MoE 大模型,主打极致性价比。主模型参数量 125B,额外配备 51B 的 N-gram Embedding,每 Token 仅激活 6B 参数,在能力、时延与成本之间取得均衡。

核心功能

  • 高效 MoE 架构:总参 125B,每 Token 仅激活 6B,成本骤降约 90%
  • 长上下文:原生支持 262,144 tokens 上下文,可通过 YaRN 扩展至 1M
  • 多模态理解:办公、编码、多模态推理等场景表现出色,办公性能对标 Claude Opus 4.6
  • 开放权重:权重已在 Hugging Face、ModelScope 开放,含 Qwen3.8-Flash-Next 新架构预览(Qwen4 系列雏形)
  • 生态覆盖:上线千问 AI 平台、阿里云百炼 Model Studio、Qwen Cloud 与 QwenWork

定价说明

  • 阿里云百炼自 8 月 27 日起下调:输入 ¥0.8 / 百万 tokens(原 ¥1),输出 ¥2.7 / 百万 tokens(原 ¥3)
  • 缓存命中:¥0.1 / 百万 tokens
  • 国际站:输入约 $0.15 / 百万 tokens

使用场景

  • 高吞吐量规模化应用与工具型工作流
  • 编程与协同办公助手
  • 成本敏感的多模态推理任务