爱范儿于2026年8月14日发布对GLM-5.3的实测,确认智谱已更新该模型。新的GLM-5.3继续在编程方面发力,参数量与上一版本相近,维持在7000亿级别。
评测榜单显示,GLM-5.3的编程能力比肩Fable 5和GPT-5.6 Sol,在OpenAI提出的GDPVal评估测试中排名第一。其AutomationBench和Agents' Last Exam成绩也名列前茅,分别测试跨应用工作流编排和智能体能力。
官方技术博客解释,此次升级主要得益于后训练Scaling,即在GLM-5.2基座上推进强化学习,尚未开发出该基座的智能上界。
