智谱开源GLM-5.3权重:AA指数60分追平Claude与GPT,国产开源再进一档

AI资讯1天前发布 EdgeClaw
1 00

8月28日晚,智谱把GLM-5.3的模型权重挂上了Hugging Face和ModelScope,正式向全球开发者开放下载。没有直播、没有Keynote,只有一篇简短的新闻稿,但这份「安静」的交付物,却被业内视为国产开源大模型的一次关键跃迁。

在权威的Artificial Analysis综合智能指数(AA Index)中,GLM-5.3拿到60分,进入全球前沿模型能力区间,与Claude Fable 5、GPT-5.6 Sol等闭源旗舰处于同一水平,并与Kimi K3并列开源模型第一。这意味着,一个可本地部署、可微调、可商用的开源模型,第一次站到了闭源旗舰的身边。

「不加参数」的升级路线

GLM-5.3最值得玩味的技术信息,写在Hugging Face页面正中的一行小字里:底座与5.2同款,全部提升来自后训练。智谱通过数据构造、RLHF/RLAIF、拒绝采样、代码执行反馈等后训练手段,把性能往上推了整整一代,这在AA指数的成本-智能对比图中体现得尤为直观。

这套「不堆参数、做深后训练」的打法,对国内绝大多数拿不到海量高端显卡的团队极具参考价值。它意味着竞争力的下一段增长曲线,不必然长在基座上,也可以长在数据与对齐这些别人没那么在意的层面。

GLM-5.3开源模型编程场景,显示器高亮代码与AI辅助编程浮动界面

能力聚焦:编码、网络安全与长程任务

智谱官方介绍,GLM-5.3擅长复杂编码、防御性网络安全以及长程任务。在Z.ai Code Bench的High档位中,它以约5万输出Token拿下31.4%准确率,超过Claude Opus 4.8最高档位的29.5%;CyberGym安全评测84.5%的成绩,也超过了多个闭源前沿模型。在长程Agent编程、跨文件重构、多轮修Bug等关键代码维度上,它已是当前最强的开源选择之一。

官方在发布权重前专门追加了两周全面安全评估。鉴于该模型在网络安全方面的先进能力,许可协议也做了精细设计:仅当年营业额超过100亿美元的机构,拟将GLM-5.3作为外部模型服务对外提供时才须安全审查;本地部署、模型微调及绝大多数商业化使用均不受此限制。

门槛更低的前沿能力

在达到同档智能水平的同时,GLM-5.3以更小的参数规模与更低的调用成本,显著降低了前沿模型能力的使用门槛。在AA的「智能-成本」评估中,它是所有前沿旗舰模型中单任务成本最低的一个,且在编码能力上表现出极强的Token效率。

GLM-5.3模型能力排名信息图,上升趋势箭头与神经网络光点背景

对于独立开发者、中小企业和科研团队而言,开源意味着可以绕过闭源API的定价与依赖,把GLM-5.3嵌入自己的代码工具、安全产品与业务系统。中国信通院牵头的大模型平台系列行业标准也在近日发布,开源权重模型正处在一个由多方力量推动的加速升温通道中。

当开源模型在能力、成本与可部署性上同时站上第一梯队,「AI平权」就不再是一句口号。GLM-5.3的开源,是这一趋势最新的注脚。

© 版权声明

相关文章