- 核心观点:智谱GLM5.3通过后训练技术显著提升模型能力,已跻身全球Coding/Agent第一梯队,AI安全能力表现突出。
- 关键数据:
- 榜单排序:GLM5.3在全球Coding/Agent榜单中位列第一梯队,排序为GPT-5.6Sol≈Fable5≥GLM5.3>KimiK3≈DeepSeekV4Pro。
- Terminal-Bench2.1:GLM5.3得分88.2,与Sol(88.8)、K3(88.3)基本持平。
- Terminal-Bench3.0:GLM5.3得分28.3,仅次于Sol/Fable。
- 其他测试:HLEw/Tools(62.5)、ALE(28.5)、GDPval-AAv2(未明确提及具体得分)。
- 研究结论:GLM5.3在后训练推动下能力加速收敛,综合性能达到全球领先水平,尤其在Coding和Agent任务上表现优异,AI安全能力同步提升。