没有一家模型厂商最近能够放松警惕。前后大概不到48小时,DeepSeek和智谱相继更新了自己的模型进展。先是DeepSeek于8月12日晚将API文档更新为DeepSeek-V4-Pro正式版,又于13日对官宣内容进行了回撤和重新发布,但调整期间保留API服务;再是8月14日,智谱GLM-5.3正式发布。抛开DeepSeek回撤和重新发布不谈,其API文档更新为DeepSeek-V4-Pro正式版,智谱GLM-5.3正式发布。在Agent相关评测集中,其总体成绩与Kimi K3、Opus 4.8和Fable 5在同一水平线上。
智谱GLM-5.3则继续强调编程能力。该模型与前代GLM-5.2使用完全相同的基座模型,主要通过后训练提升性能,利用强化学习(基于IndexShare、SAO以及新一代Slime框架)扩展了长程任务环境和训练时长。从评测集表现来看,GLM-5.3的部分能力接近Fable 5和GPT-5.6 Sol,并在展示出来的多个榜单中成绩超过了Kimi K3,但在聚焦长程软件工程与持续代码修改能力的DeepSWE v1.1上仍然不及K3。