北京商报讯(记者 魏蔚)8月14日,智谱发布GLM-5.3,与GLM-5.2相比,基座模型没变,但通过极致的后训练Scaling(规模)大大提高了模型的智能上界:数十倍的长程任务环境、更丰富多样的环境类型、超长的后训练时间。智谱称,其发现充分的模型后训练涌现出超出预期的模型能力。
在编程方面,GLM-5.3在内部自建体感评测中较GLM-5.2提升50%,在包括Terminal Bench 3.0、Agents' Last Exam (CLI)在内的公开基准测试中取得开源第一。网络安全能力方面,在白盒代码审查与漏洞发现等安全任务中,GLM-5.3的表现持平Mythos 5,展现出面向网络安全防御场景的强大潜力。
据智谱介绍,上述全部提升都来自后训练。基于IndexShare、SAO、以及持续演进的新一代Slime框架,智谱在与GLM-5.2完全相同基座上高效推进强化学习。
智谱将在发布两周后开放模型权重,此前完成安全评估与模型加固。即日起上线智谱官方编程工具ZCode、效率工具AutoClaw,上线GLM Coding Plan全量用户及开放订阅。TraeWork/TraeCode/扣子、WorkBuddy/CodeBuddy、Qoder/QwenWork、CatPaw、JoyCode、OpenCode等编码平台开放抢先体验。