Anthropic联合美方机构扩容模型访问,面向可信主体开放尖端AI能力

在周二对外发布的官方声明中,总部位于旧金山的AI企业Anthropic宣布,将与美国相关机构展开合作,进一步扩大旗下顶尖AI模型的使用权限。这次开放并非面向普通大众,仅对经过严格筛选与核验的机构开放,授权其使用Anthropic具备顶尖网络安全分析能力的模型,开展针对性安全测试。

按照本次发布的方案,符合资质的机构可以调用Anthropic当前性能最强的多款模型,其中包含Claude Opus 5.5、Claude Sonnet 5.5以及Claude Mythos 5.1,未来公司推出的新一代前沿模型,也会纳入这套授权使用体系。

模型用途限定:面向关键基础设施开展高风险攻击性测试

本次开放的核心应用场景,是针对支撑社会运转的关键基础设施防护体系,进行高风险攻击性安全测试。这类测试属于网络安全领域常见的白帽攻防演练,目标系统覆盖电网、银行业务平台、航班调度运行系统等,都是一旦遭遇入侵就会造成大范围影响的核心设施。

简单来说,拿到访问权限的安全团队,可以借助AI模型模拟黑客攻击行为,主动寻找系统内潜藏漏洞,在真实恶意攻击者利用漏洞之前完成修补。整个测试的目的是强化防护体系,而非发起真实网络入侵。

玻璃翼计划先期落地,Mythos模型改写网络安全攻防格局

这套定向授权机制并不是刚刚诞生,今年4月Anthropic就正式启动名为玻璃翼计划(Project Glasswing)的项目,先期向美国政府相关机构、金融企业以及大型软件服务商有限开放Mythos模型。

Mythos模型的推出,在网络安全行业被视作一个重要转折点。这款模型可以自动完成一部分高级黑客的工作流程,自动化寻找漏洞、尝试利用缺陷,大幅降低复杂网络攻击的技术门槛。正是因为模型具备这样强大的能力,Anthropic从一开始就没有对全社会开放,只限定给负责系统防御的机构使用。

AI模型安全事件频发,行业对前沿模型风险关注度持续上升

在玻璃翼计划推出之后,行业内接连出现多起AI模型意外侵入政府、企业以及非营利组织信息系统的事件。连续发生的案例,让技术界和企业开始重新审视前沿AI模型的潜在安全隐患,关于这类能力如何管控的讨论持续增多。

很多从业者担心,这类能够自动执行网络探测与漏洞利用的模型,如果落入恶意人员手中,会带来难以预估的破坏。在此背景下,由可信机构优先使用AI进行防御性测试,成为行业探索风险管控的一种思路。

新一轮扩容延续严格审核机制,原有参与机构自动纳入范围

Anthropic在周二的公告中说明,本轮扩大访问范围,会保留玻璃翼计划原有全部参与机构。同时,企业会配合美国相关机构,对所有申请加入的新机构开展完整资质审核,只有通过核验的主体,才能够获得模型的调用权限。

这套机制的核心逻辑,是把强大的AI网络探测能力限制在可信安全团队手中,用攻击能力来加固防御。在AI自动化黑客能力快速进步的阶段,提前排查关键基础设施的安全短板,降低未来遭遇真实网络攻击的可能性。

从整个行业的发展趋势来看,前沿大模型的网络攻防能力已经不再停留在理论层面。如何划定使用边界、建立严格准入,已经成为AI企业和基础设施运营方都必须面对的现实课题。玻璃翼计划的持续扩容,也是产业界尝试平衡AI能力释放与风险管控的一次重要实践。

(素材来自:Anthropic 算芯能前沿网综合)

标签:AI模型

本文由智算芯能前沿网编辑整理,转载请注明出处。