智谱发布GLM-5.3:后训练Scaling驱动编程能力跃升50%,登顶开源第一
智谱发布GLM-5.3:后训练Scaling驱动编程能力跃升50%,登顶开源第一
8月14日智谱发布新一代旗舰模型GLM-5.3,基座权重未变全部提升来自后训练Scaling,编程能力较5.2提升50%,在Terminal-Bench等公开基准登顶开源第一。
8月14日,智谱AI正式发布新一代旗舰模型GLM-5.3。与GLM-5.2相比,该模型基座权重完全未变,所有性能提升均来自后训练(Post-training)阶段的Scaling投入,包括数十倍长程任务环境、更丰富的环境类型与超长后训练时间。
核心突破:
- 编程能力跃升50%:官方内部体感评测显示,GLM-5.3编程能力较GLM-5.2提升达50%
- 开源基准第一:在Terminal-Bench 3.0、Agents' Last Exam (CLI)等公开基准测试上取得开源模型第一名的成绩
- 安全能力突出:在白盒代码审查与漏洞发现等安全任务中表现持平Mythos 5
- 后训练Scaling验证:此次升级证明在基座模型不变的情况下,通过大规模后训练仍可实现显著性能跃升,为行业提供了新的Scaling方向
- 上线计划:即日起已上线ZCode、AutoClaw及GLM Coding Plan,API即将推出,完整权重预计两周后开源,京东云MaaS平台已于发布当日完成接入
GLM-5.3的发布是国内大模型厂商在后训练Scaling方向的一次重要实践,也标志着智谱在开源编程模型领域进一步巩固了领先地位。