
8月24日,日本经济新闻旗下平台NIKKEI Digital Governance携手美国企业Weights & Biases,联合发布最新一期全球生成式AI实力调研评估报告。本次榜单数据显示,国内AI企业月之暗面推出的Kimi K3模型综合实力大幅攀升,位列全球第6名,综合得分成功超越谷歌、SpaceXAI等海外主流模型。除此之外,智谱华章、阿里云等多家国内机构的AI产品也在榜单中取得靠前排名,展现出中国AI模型的整体进阶实力。
从细分维度评分表现来看,Kimi K3各维度能力呈现明显分化。在软件开发能力维度,也就是模型自主编程水平指标中,该模型位列全球第9位;在稳定性与容错能力相关的可靠性指标上,排名全球第8位,核心性能已经达到国际第一梯队水准。不过报告也指出了模型的明显短板,在伦理观维度排名仅为全球第33位,评分表现偏弱。该项指标主要衡量模型规避违规、违法、违背伦理内容输出的能力,这也意味着Kimi K3虽然具备对标美国主流模型的强劲性能,但依旧存在被恶意主体利用的潜在风险,安全合规能力仍有提升空间。

除了榜单量化评分体现的优劣势之外,低成本优势是Kimi K3另一大核心竞争力,也是未在评分体系中体现的突出特点。不同于OpenAI、Anthropic等美国企业采用的按量计费闭源服务模式,Kimi K3采用开源开放模式,各类用户均可自主下载模型,部署在自有或合作服务器中运行,大幅降低了企业与开发者的落地使用成本,相较美国商业化模型具备显著的性价比优势。
本次全球测评中,实现突围的国产AI模型并非只有月之暗面。国内多家科创企业与头部科技企业的模型均顺利登榜,其中智谱华章的GLM-5.2模型位列全球第18名,稀宇科技M3模型位居第28名,阿里云自研模型同样跻身全球前列。整体来看,这批上榜的国产模型普遍采用开源商业模式,依托高性能、低成本的双重优势,持续拓展全球市场空间,稳步提升市场占有率。
本文由智算芯能前沿网编辑整理,转载请注明出处。
