智谱20260814:GLM5.3发布,后训练持续scaling,coding能力稳坐国内第一梯队 GLM5.3能力提升来自后训练scaling 本次大幅扩展任
- 序号:096
- 星球链接:打开网页
- 附件:图片 0,音频 0,文档 0
- 音频文件:无音频
图片
无图片
正文
智谱20260814:GLM5.3发布,后训练持续scaling,coding能力稳坐国内第一梯队 GLM5.3能力提升来自后训练scaling 本次大幅扩展任务环境、环境类型和训练时长,在预训练参数未扩大情况下模型能力明显提升。预计后续强后训练能力加上预训练参数扩大能够展望更强大的模型智能水平! Coding能力稳居国内第一梯队、接近Fable5 GLM5.3编程体感相比5.2提升约60%,terminalBench2.0、Agents'LastExam等benchmark中超过K3,DeepE与K3相当。在真实软件漏洞分析的CyberGym中超过Mythos5。此外专业任务执行能力提升,在GDPval-AAv2中超过K3。 Coding+长程Agent能力增强推动复杂专业Agent能力提升 GLM5.3在代码审计、漏洞发现和漏洞推理能力显著提升,在白盒漏洞发现等任务上接近Mythos5/GPT5.6Sol,发布前两周与国内多家安全团队合作测试中累计发现2400+漏洞,其中1000+为中高危。 强调能力和效率的平衡 Z.aiCodeBench中GLM5.3High档位下准确率31.4%,单任务平均输出约5万tokens,ClaudeOpus4.8准确率29.5%,单任务平均输出需要12万tokens。 产品和商业化同步推进 GLM-5.3上线ZCode、AutoClaw和GLMCodingPlan,并已经接入多家外部Coding/Agent平台;API很快上线。模型权重会在两周安全评估和加固完成后正式开源。
总体总结
主题正文
- 智谱20260814:GLM5.3发布,后训练持续scaling,coding能力稳坐国内第一梯队
- 预计后续强后训练能力加上预训练参数扩大能够展望更强大的模型智能水平!
- GLM5.3编程体感相比5.2提升约60%,terminalBench2.0、Agents'LastExam等benchmark中超过K3,DeepE与K3相当。
- 在真实软件漏洞分析的CyberGym中超过Mythos5。
- 此外专业任务执行能力提升,在GDPval-AAv2中超过K3。
- GLM5.3在代码审计、漏洞发现和漏洞推理能力显著提升,在白盒漏洞发现等任务上接近Mythos5/GPT5.6Sol,发布前两周与国内多家安全团队合作测试中累计发现2400+漏洞,其中1000+为中高危。
- Z.aiCodeBench中GLM5.3High档位下准确率31.4%,单任务平均输出约5万tokens,ClaudeOpus4.8准确率29.5%,单任务平均输出需要12万tokens。
- GLM-5.3上线ZCode、AutoClaw和GLMCodingPlan,并已经接入多家外部Coding/Agent平台;