智谱发布GLM5.3,核心提升在于后训练能力,大幅扩展了长程任务环境、环境类型和训练时长。主要提升Coding能力,体感相比5.2提升约50%,仅靠7000亿参数通过后训练实现多项能力达到与KimiK3互有胜负的水平,主要体现在长程、复杂的软件工程与任务执行能力,而非简单写代码或做Demo。后训练基于IndexShare、SAO及持续演进的新一代Slime框架,效果显著,但基座尚未达到智能上限。期待后续参数量扩展后的表现,用更短的执行路径完成任务将使costpertask优势更显著。自研的Z.aiCodeBench支持长程任务环境、环境类型和训练时长的扩展。