智谱GLM-5.3发布:开源大模型新标杆,编程能力直追Claude

智谱GLM-5.3
GLM-5.3性能对比

智谱今天正式发布了GLM-5.3大模型,距离创始人预告仅几个小时。这次升级虽然基座参数量仍保持7400亿不变(万亿参数可能留给后续版本),但通过强化后训练,整体性能相比GLM-5.2提升了50%。

开源模型中的最强者

智谱官方表示,GLM-5.3在多项主流基准测试中排名开源模型第一。更值得关注的是它的编程和智能体能力——已经逼近Claude Fable 5的水平,实际编码体验超过其他国产模型。

来看几个硬核数据:

  • Terminal-Bench 3.0(真实终端复杂任务):从4.6分飙升至28.3分
  • DeepSWE v1.1(长程软件工程):从46.2分提升至66.9分
  • Agents Last Exam(跨工具协作):从23.8分提升至28.5分
  • GDPval-AA v2(44种职业知识工作):得分1769

编程效率更优

智谱自研的Z.ai Code Bench测试显示,GLM-5.3在效果和Token利用率之间取得了出色平衡。High档位下准确率达到31.4%,超过Claude Opus 4.8的29.5%,而且每项任务平均只需约5万tokens,Opus 4.8则需要约12万——也就是说,GLM-5.3能用更少的思考量完成同样的任务。

已开放体验

目前GLM-5.3已接入智谱官方编程工具ZCode和效率工具AutoClaw,GLM Coding Plan全量用户可用。Trae、扣子、CodeBuddy、Qoder等第三方编码平台也开放了抢先体验。

API即将上线,完整模型权重将在两周内开源。智谱表示需要先完成安全加固,限制潜在攻击能力,保留防御价值。

另外,今天13:00 GLM Coding Plan全员额度已重置,用户后台可见使用额度回满。

本文地址:https://www.163264.com/14897

(0)
AI早报:DeepSeek V4 Pro 正式版上线;小红书要用 AI 当导购;Grok 4.6 正式发布
上一篇 16小时前
下一篇 10小时前

相关推荐