导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜
快讯 机构 观点 人物 专题

中国AI实验室Z.AI发布GLM-5.3:自称最强开源编码模型,效率与安全性能大幅提升

中国人工智能实验室Z.AI于周四正式发布GLM-5.3,将其定位为市场上最强的开源权重编码模型。该模型目前可通过GLM Coding Plan订阅和ZCode使用,API接口和可下载权重将在安全审查后陆续开放。

Z.AI在发布公告中表示,GLM-5.3的核心改进在于扩展后训练(scaling post-training)。公司写道:“GLM-5.2我们构建了技术栈……过去一个月我们持续在该技术栈上扩展:更多环境、更多样化任务,以及更多的计算资源用于训练。”

Myriad: When will OpenAI release GPT-6? Click to make your prediction.

Z.AI在令牌(token)效率上投入更多精力,而非单纯追求基准测试的绝对优势。GLM-5.3拥有7430亿参数,处理每个任务消耗的token数量显著低于前代。参数是模型处理信息时的调节旋钮,token则是模型消费或生成信息的基本单元。

根据Z.AI的内部Z.AI Code Bench测试,GLM-5.3在Max effort设置下得分为34.5%,每个任务约消耗75,000个输出token;而GLM-5.2得分为23.4%,每个任务消耗96,000个输出token。与闭源模型相比,GLM-5.3在token经济性上优于Claude Opus 4.8,但在Max effort下仍落后于Claude Fable 5(得分39.5%)。

China's Z.AI Unveils GLM-5.3, Claims Top Open-Weight Coding Model with Higher Efficiency and Strong Security Gains

在编码能力方面,GLM-5.3表现出色,在多数相关基准测试中超越了同为中国模型的Kimi K3。在Terminal Bench 3.0(真实Linux环境下的自主Shell/工具使用测试)中,GLM-5.3得分为28.3,略低于闭源模型Fable 5(33.7)和GPT-5.6 Sol(34.6)。在DeepSWE v1.1(端到端修复真实GitHub问题的基准)中,开源竞争对手Kimi K3(67.5)和Fable 5(69.7)均超过GLM-5.3的66.9。总体而言,GLM-5.3超越了自身前代和部分开源同行,但头部闭源美国模型在主要编码排行榜上仍处于领先地位。

网络安全方面的提升也引人注目。GLM-5.3在CyberGym测试中达到84.5%的领先得分,在漏洞利用基准测试上较GLM-5.2提升了一倍多。Z.AI表示,该模型在269个开源项目中标记了2,436个漏洞,其中1,097个为中高危漏洞。

Z.AI在X平台上表示:“GLM-5.3将智能体编码提升到一个新水平,相比GLM-5.2实现了戏剧性改进,同时用更少的输出token取得更好的结果。GLM-5.3现已通过GLM Coding Plan和ZCode提供,API和开放权重将在严格安全评估后分阶段发布。”

价格方面,与美方前沿模型的差距成为开源权重的吸引力。Z.AI的GLM Coding Plan采用积分配额制(低谷时段调用半价),智谱API定价约为美国前沿模型每token费率的十分之一——GLM-5.2的官方费率为每百万token输入1.40美元、输出4.40美元。相比之下,GPT-5.3-Codex为输入1.75美元/输出14美元,Claude Opus 4.8则处于Anthropic定价层级的高位。

Z.AI是一家位于北京的研究实验室,已被列入美国实体清单,意味着美国企业不得向其出口受控技术。尽管如此,GLM系列模型依然广受欢迎,中国开源权重模型在OpenRouter的token使用量上已经超过美国模型。根据发布公告,GLM-5.3的权重预计约两周后公开发布——目前“开源权重”的标签指向即将到来的版本,而非今日即可下载的内容。