DeepSeek V4-Flash登顶全球大模型调用榜,国产大模型包揽OpenRouter前五改写全球AI格局
8月10日,全球模型聚合平台OpenRouter最新周度Token调用榜单出现历史性变化:前五名全部被国产大模型占据,DeepSeek V4-Flash正式版以8.83万亿Token周调用量位居第一,环比增长570%,标志着国产大模型商用热度首次全面超越GPT、Claude等海外主流模型阵营。
核心数据:
- 榜首位置:DeepSeek-V4-Flash-0731(正式版)周调用量8.83万亿Token,环比增长570%,单日使用量和新增订阅用户均增长约30%
- 前五包揽:小米MiMo V2.5、腾讯Hy3(8.05万亿Token)、DeepSeek V4-Flash预览版(5.88万亿Token)、智谱GLM5.2依次位列第二至第五名
- 中国领跑:上周全球AI大模型总调用量69万亿Token,中国大模型周调用量达34.25万亿Token,连续十五周超过美国(9.17万亿Token)
- 极致性价比:DeepSeek V4-Flash完成单项测试任务平均成本约0.03美元,仅为Claude旗舰模型的1/100,官方定价为每百万Token输入1元、输出2元
技术优势解析:
DeepSeek V4-Flash正式版通过混合专家(MoE)架构、稀疏注意力和长上下文压缩等技术路径,在百万级上下文、推理能力、工具调用和低价格之间实现了有效平衡。正式版在Agent能力上大幅增强,基准测试远超预览版本。小米MiMo V2.5、腾讯Hy3、智谱GLM 5.2则分别在多模态、代码生成、复杂推理等方向上形成互补。
国产大模型的突出优势已扩展到全链路工程能力,国内企业能够快速完成灰度测试、正式发布、接口迁移和多平台分发,将技术进步迅速转化为全球开发者的实际调用。MoE架构通过降低参数激活比有效压缩推理成本,为低价API策略提供了技术支撑。
产业机遇与挑战:
中国电子信息产业发展研究院专家指出,国内AI企业可利用当前窗口吸引全球开发者,由低价API服务逐步延伸至推理工具链、行业解决方案等高附加值环节。调用量增长还将拉动国产推理芯片、服务器、存储等基础设施需求,为软硬件协同优化提供真实场景。
但挑战同样不容忽视:高调用未必带来高利润,持续低价可能压缩利润空间;海外市场对版权合规、网络安全及审计的要求日益严格。企业需要将价格优势转化为稳定服务能力、合规交付能力和开发者生态,才能在全球AI竞争中持续领先。
OpenAI GPT-5.6 Luna以4.43万亿Token周调用量进入前五(环比增长128%),谷歌Gemini 3.6 Flash首次进入榜单排名第九(2.33万亿Token,环比增长446%),但均已被国产模型全面超越。