智谱发布GLM-5.3大模型:Terminal-Bench成绩超越DeepSeek V4-Pro,定价不变

正飞GEO 2026年08月19日 12:03 1 阅读 来源:InfoQ
智谱发布GLM-5.3大模型:Terminal-Bench成绩超越DeepSeek V4-Pro,定价不变 智谱发布GLM-5.3大模型:Terminal-Bench成绩超越DeepSeek V4-Pro,定价不变
智谱AI于8月19日发布GLM-5.3模型,在Terminal-Bench基准测试中超越Fable及DeepSeek V4-Pro 0813版本,API定价保持与GLM-5.2一致,专为编程、网络安全和长周期智能体任务设计。

智谱AI(Zai_org)于2026年8月19日正式发布GLM-5.3大模型,在多项核心基准测试中取得显著突破,官方数据显示其在Terminal-Bench上的表现已超越Fable及前一天刚发布的DeepSeek V4-Pro 0813版本。

GLM-5.3以GLM-5.2为底座,在后训练阶段投入了比以往更多的计算资源,专门针对多样化的长周期任务进行优化。智谱官方表示开放权重已达到"逃逸速度",国产大模型在代码智能体领域正快速追赶国际前沿水平。

核心性能提升:

  • Terminal-Bench 3:从4.6提升至28.3,提升幅度超过5倍
  • DeepSWE:从46.2提升至66.9,软件工程能力大幅增强
  • ExploitBench:从24.4提升至54.4,网络安全能力翻倍
  • CyberGym:达到84.5%,声称超越Mythos 5

API定价(保持不变):

  • 输入:$1.40/1M tokens
  • 输出:$4.40/1M tokens
  • 缓存输入:$0.26/1M tokens

GLM-5.3专为三大核心场景设计:编程开发、防御性网络安全和长周期智能体(Agent)任务。目前该模型API已正式上线,用户可通过智谱官方API及合作伙伴模型网关访问使用。

在国产大模型竞赛日趋激烈的背景下,智谱GLM-5.3的发布标志着中国AI企业在代码智能体和网络安全垂直领域的技术实力正在快速提升,尤其是在Terminal-Bench这类考验真实编程和系统操作能力的基准上,国产模型已具备与国际顶尖模型一较高下的实力。

分享到: