GLM-5.3-Flash

GLM-5.3-Flash

智谱AI开源的GLM-5系列首个原生多模态MoE大模型,总参数320B仅激活18B,MIT协议开放权重,性能逼近闭源旗舰而价格仅为其数十分之一。

月访问量
0
累计浏览
1
用户评分
4.6
收录时间
2026-08

产品介绍

智谱AI推出的GLM-5 系列首个原生多模态 MoE 大模型,总参数 320B、激活参数 18B(320B-A18B),MIT 协议开放权重。此前曾以匿名模型 Ox Alpha 在 OpenRouter、OpenCode 全球开发者社区引发热议。

核心功能

  • 原生多模态:支持文本、图像、视频多模态输入,GLM-5 系列首款原生多模态模型
  • 稀疏+线性注意力混合架构:总参数 320B,每 Token 仅激活 18B 参数,推理成本大幅下降
  • MIT 开放权重:上线即登陆 Hugging Face,可自由下载、商用与二次开发
  • 国产算力承载:全部线上流量由约 10 万张国产芯片承载,摩尔线程 MTT S5000 等完成 Day-0 适配
  • 极致性价比:Artificial Analysis 智能指数 57 分,单任务成本约 0.09 美元

定价说明

  • 输入:¥0.8 / 百万 tokens
  • 输出:¥2.8 / 百万 tokens
  • 缓存命中:¥0.23 / 百万 tokens

定价约为 GLM-5.3 的十分之一(限时折扣低至二十分之一),仅为 Claude Opus 4.8 的四十分之一。

使用场景

  • 高并发、成本敏感的大规模推理
  • 编程与智能代理(Agent)任务
  • 多模态内容理解与生成