产品介绍
产品介绍
Qwen3.8-Max 是阿里巴巴通义千问团队于 2026 年 8 月 3 日正式发布的 Qwen 家族迄今最强大模型,参数规模扩展至 2.4 万亿(激活参数 95B),支持 100 万上下文 Tokens。2026 年 8 月 13 日,千问团队正式开放 Qwen3.8-2.4T-A95B 模型权重,这是阿里首次将 Max 级别旗舰模型对外开放权重,也是中国开源大模型布局的关键落子。
开源版 Qwen3.8-2.4T-A95B 原生支持 262,144 Token 上下文,可扩展至 101 万 Token。模型默认以思考模式运行,在编程、办公、科研工作、长周期智能体任务上实现性能提升。PaperBench 论文复现基准 93.0 分,高于 GPT-5.6 Sol 和 Fable 5;OSWorld-Verified 电脑操作能力 86.1 分位居首位。
核心功能
- 2.4 万亿参数 MoE 架构:95B 激活参数,性能与效率的平衡
- 100 万 Token 上下文窗口:超长文档理解与代码库分析
- 权重已开源(2026.8.13):Qwen3.8-2.4T-A95B 在 HuggingFace 和魔搭社区开放下载
- 长程自主编程:独立运行 16 天完成 oh-my-cli 项目,累计 265 次 commits、127 个 PR
- 科研复现与超越:PaperBench 93.0 分,5 天独立复现顶会论文并超越原方法
- 专业办公能力:1 小时完成 1,284 条法务条款审查,芯片设计将门数从 8,298 优化至 678
- 多模态智能体:混合编程与 GUI 操作能力,RecreationBench 展现前沿水平
- 电商经营模拟:E-Commerce Bench 365 天经营 4.16× 回报,比第二名高 38%
- Qwen3.8-27B 即将发布:更小尺寸模型也在开源计划中
性能表现
Qwen3.8-Max 在 Arena 榜单中表现出色,Text Arena、CodeArena、VisionArena 均位居前列,综合能力全球仅次于 Anthropic Fable 5。PaperBench 93.0 分超越 GPT-5.6 Sol 和 Fable 5;OSWorld-Verified 86.1 分位居首位;参数化 CAD 基准 91.5 分超过 Fable 5、GPT-5.6 Sol 和 Gemini 3.1 Pro。
开源部署
模型权重下载:
- HuggingFace:https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B
- 魔搭社区:https://modelscope.cn/models/Qwen/Qwen3.8-2.4T-A95B
支持 SGLang、vLLM 和 TokenSpeed 推理引擎部署。Unsloth AI 已将 4.9TB 模型压缩至 397GB(缩减 91%),设备内存+显存 410GB 以上即可本地运行。
API 调用
from openai import OpenAI
client = OpenAI(
api_key="your-dashscope-key",
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1"
)
response = client.chat.completions.create(
model="qwen3.8-max",
messages=[{"role": "user", "content": "分析这段代码的性能瓶颈"}]
)
print(response.choices[0].message.content)
API 定价:国内输入 ¥12/百万 tokens,输出 ¥36/百万 tokens;海外输入 $2/百万 tokens,输出 $6/百万 tokens。
典型使用场景
- 长周期自主编程和智能体任务
- 科研论文复现与算法创新
- 企业级法务审查和芯片设计
- 电商经营模拟和决策优化
- 私有化部署(开源权重自托管)
平台支持
通过阿里云百炼平台、DashScope API 访问,开源版可在 HuggingFace 和魔搭社区下载。