8月14日,智谱AI正式发布新一代GLM-5.3模型。CNMO科技获悉,该模型的基座模型与GLM-5.2保持一致,但经过更大规模、更长训练周期,以及在多样化长程任务环境中的强化学习训练后,GLM-5.3在编程能力和Agent智能体能力方面实现了明显提升,并进一步展现出较为突出的网络安全攻防能力。

智谱
智谱方面表示,在代码审查、漏洞检测与安全防御等应用场景中,GLM-5.3已经展现出较强潜力;不过在面对更复杂的漏洞利用链和高级攻防任务时,这一AI大模型仍有进一步优化和提升空间。


据智谱披露,在衡量AI模型是否能够在真实终端环境中完成复杂任务的Terminal-Bench 3.0测试中,GLM-5.3的得分由4.6大幅提升至28.3;在更强调长程软件工程能力以及持续代码修改表现的DeepSWE v1.1基准中,成绩也从46.2提升至66.9;而在覆盖多类真实专业场景、注重跨工具协同和长程任务处理能力的Agents' Last Exam中,得分则由23.8提高到28.5。与此同时,在覆盖44种职业、重点考察真实高价值知识工作能力的GDPval-AA v2评测中,GLM-5.3获得1769分,进一步体现出其依托编程能力所涌现出的专业任务执行与复杂问题处理水平。

智谱AI宣布,GLM-5.3即日起正式上线ZCode、AutoClaw及GLM Coding Plan,且GLM Coding Plan使用额度已同步重置。与此同时,相关API接口也将很快推出,完整模型权重则将在完成必要的安全评估与安全加固后,于未来两周内向公众开放。
