松果财经讯,8月14日,智谱AI正式发布新一代旗舰模型GLM-5.3,在基座模型与GLM-5.2完全相同的前提下,通过极致的后训练Scaling实现了能力跃升。新模型在内部体感评测中编程能力较前代提升50%,在Terminal Bench 3.0、Agents' Last Exam等公开基准测试中取得开源模型第一的成绩,编程与智能体能力已接近Anthropic顶级模型Claude Fable 5,编程体感超越其他国产模型。
值得一提的是,GLM-5.3在网络安全领域展现出"意料之外"的能力。在白盒代码审查与漏洞发现任务中,其表现已与行业标杆Mythos 5持平。在漏洞验证测试CyberGym中,GLM-5.3得分达83.5%至84.5%,显著高于前代的77.2%。智谱方面表示,安全能力的涌现并非偶然——"安全工作本质上是约束严格的编程能力",团队自2025年9月起便在该方向持续投入。
在真实编程场景的Z.ai Code Bench评测中,GLM-5.3展现出优异的Token利用率。在High思考档位下,模型准确率达31.4%,超越Claude Opus 4.8最高档位的29.5%;每项任务平均输出约5万tokens,而Opus 4.8需约12万tokens,意味着用更短的执行路径完成了更准的任务。
即日起,智谱官方编程工具ZCode与效率工具AutoClaw同步上线,GLM Coding Plan面向全量用户开放订阅,API亦将很快上线。智谱表示,完成安全评估与模型加固后,完整模型权重将在两周内正式开源。从GLM-5.2到GLM-5.3,同一个基座模型通过后训练仍能持续释放潜力,智谱坦言:"可能我们还远未开发出这个基座的智能上界。"