8月14日,智谱AI正式推出全新升级的GLM-5.3大模型,兑现了创始人唐杰此前预告的“史诗级plus”产品迭代。不同于行业主流的参数扩容升级思路,本次更新并未更换模型基座,依旧维持7530亿的参数规模,产品性能的全面突破完全依托后训练体系优化实现。通过延长训练时长、丰富任务训练场景、扩大强化学习迭代规模等一系列精细化优化手段,智谱打造出独有的“后训练Scaling”迭代模式,同时认为当前模型基座的智能潜力仍有巨大挖掘空间,尚未触及能力天花板。

根据智谱官方披露的技术评测数据,GLM-5.3在多项权威基准测试中实现大幅突破,多项成绩位列开源模型首位。在聚焦真实终端复杂任务落地能力的Terminal-Bench 3.0评测中,模型得分从上一代GLM-5.2的4.6大幅攀升至28.3;侧重长周期软件工程开发能力的DeepSWE v1.1测试中,得分从46.2提升至66.9,两项核心指标均领跑开源赛道。在覆盖44类职业知识应用场景的GDPval-AA v2评测中,GLM-5.3取得1769的高分,超越前代产品1508的得分,同时高于Kimi K3 1682的评测成绩。

网络安全能力的突破性升级是本次GLM-5.3迭代的核心亮点之一。随着全球前沿大模型能力持续进阶,OpenAI、Anthropic等海外厂商相继暴露模型安全治理短板,行业逐渐形成共识,安全可控能力已成为大模型规模化商用、获得市场信任的核心必备条件。依托深度安全能力优化,GLM-5.3在专业漏洞评测场景中表现亮眼,在国际漏洞推理测试CyberGym中取得84.5%的成绩,超越Anthropic Mythos 5的83.8%与GPT-5.6 Sol的83.6%。在难度更高、需要精准研判漏洞成因并完成验证利用的ExploitBench评测中,模型得分达到54.4%,较上一代24.4%的成绩实现翻倍增长,快速逼近国际顶尖模型水平。

GLM-5.3的迭代落地,恰逢全球大模型市场定价格局剧烈调整的关键节点。近期海外头部AI厂商集体开启降价模式,抢占市场份额。8月4日,OpenAI大幅下调GPT-5.6 Luna接口价格,每百万tokens输入价格由1美元降至0.2美元,降幅达80%;谷歌随后推出Gemini 3.7 Flash模型,限时推出五折优惠活动,Anthropic也将Claude Opus 5定价下调至Fable 5的一半。行业普遍认为,海外厂商集中降价,核心是为了对冲Kimi K3、DeepSeek V4等国产高性能模型带来的市场冲击。

针对全新的GLM-5.3模型,智谱目前尚未公布具体调价方案。按照原有GLM-5.2定价标准,模型每百万tokens输入价格8元、输出价格28元,与DeepSeek V4-Pro高峰时段9元输入、27元输出的价格基本持平。在海外降价、国产涨价的双向市场变局下,智谱走出了差异化的技术迭代路径,放弃行业盛行的万亿参数竞赛,聚焦后训练工程体系优化,充分挖掘现有模型基座的性能潜力。

本文由智算芯能前沿网编辑整理,转载请注明出处。