智谱在 8 月 14 日发布新一代基座模型 GLM-5.3。总参数 7430 亿,与 GLM-5.2 共用同一个基座,这一代的提升全部来自后训练,做法是把长程任务环境扩大数十倍,同时拉长后训练时长。
编程是官方主推的方向。内部自建评测显示 GLM-5.3 较 GLM-5.2 提升 50%,在 Terminal Bench 3.0 和 Agents' Last Exam (CLI) 上拿到开源第一。token 消耗这一项的差距更明显,High 档位下 GLM-5.3 准确率 31.4%,高于 Claude Opus 4.8 最高档的 29.5%,平均每项任务输出约 5 万 token,Opus 4.8 需要约 12 万。同样的活,推理账单差出一倍多。
网络安全能力也一并公布。CyberGym 漏洞推理评测得分 84.5%,GLM-5.2 为 77.2%。发布前两周智谱联合安全团队做过一轮实测,扫出 2404 个潜在漏洞,其中 1088 个属于中高危。
接入方面,智谱自家的 ZCode、AutoClaw 和 GLM Coding Plan 全量用户当天可用,Qoder、OpenCode 等第三方编码平台开放抢先体验。权重当天没有放出,官方说法是发布后两周开源,打算本地部署的还得再等。