

智谱今天正式发布了GLM-5.3大模型,距离创始人预告仅几个小时。这次升级虽然基座参数量仍保持7400亿不变(万亿参数可能留给后续版本),但通过强化后训练,整体性能相比GLM-5.2提升了50%。
开源模型中的最强者
智谱官方表示,GLM-5.3在多项主流基准测试中排名开源模型第一。更值得关注的是它的编程和智能体能力——已经逼近Claude Fable 5的水平,实际编码体验超过其他国产模型。
来看几个硬核数据:
- Terminal-Bench 3.0(真实终端复杂任务):从4.6分飙升至28.3分
- DeepSWE v1.1(长程软件工程):从46.2分提升至66.9分
- Agents Last Exam(跨工具协作):从23.8分提升至28.5分
- GDPval-AA v2(44种职业知识工作):得分1769
编程效率更优
智谱自研的Z.ai Code Bench测试显示,GLM-5.3在效果和Token利用率之间取得了出色平衡。High档位下准确率达到31.4%,超过Claude Opus 4.8的29.5%,而且每项任务平均只需约5万tokens,Opus 4.8则需要约12万——也就是说,GLM-5.3能用更少的思考量完成同样的任务。
已开放体验
目前GLM-5.3已接入智谱官方编程工具ZCode和效率工具AutoClaw,GLM Coding Plan全量用户可用。Trae、扣子、CodeBuddy、Qoder等第三方编码平台也开放了抢先体验。
API即将上线,完整模型权重将在两周内开源。智谱表示需要先完成安全加固,限制潜在攻击能力,保留防御价值。
另外,今天13:00 GLM Coding Plan全员额度已重置,用户后台可见使用额度回满。
本文地址:https://www.163264.com/14897


微信扫一扫,鼓励一下~