8月31日,AMD、思科(Cisco)和沙特主权基金PIF旗下的AI基础设施公司HUMAIN联合宣布,基于AMD Instinct MI355X GPU的AI生产系统已在沙特阿拉伯正式上线并投入运营。
该部署是三方此前宣布的合资项目首个落地节点。系统采用AMD Instinct MI355X加速器、AMD EPYC处理器,搭配基于Cisco Silicon One芯片的N9000系列网络平台和800G光互连技术。
AMD称这套网络架构针对AI集群规模做了优化,具备低延迟和高运行韧性。目前,该系统已用于HUMAIN的GPU即服务(GPU-as-a-Service)业务,面向客户提供从模型训练到推理的完整算力租赁服务。
HUMAIN是PIF旗下的全栈AI解决方案提供商。此次三方合作意味着沙特在AI算力基础设施上走出了实质性的一步——不再只是采购算力,而是在本土部署了一套可对外提供服务的生产级AI集群。
扩张路线图:250MW与1GW
更值得关注的,是三方同步公布的扩张时间表。
根据AMD官方披露,合资项目计划从2027年开始,再部署最高250MW的AI基础设施增量。这一阶段将使用AMD下一代Instinct MI400系列GPU、EPYC CPU和ROCm软件栈,搭配思科网络和关键基础设施。
新产能预计在2027年下半年开始逐步上线。AMD同时表示,合资项目仍按计划推进,目标是在2030年前在沙特建成最高1GW的AI基础设施。
需要强调的是,250MW和1GW均为三方公布的部署目标,而非已安装的现成容量。目前真正投入运营的,是MI355X系统这一具体节点。

AMD Instinct MI355X GPU
架构看点:不止是GPU
从技术架构来看,这套系统的设计思路对基础设施团队有参考价值。
大规模AI集群的瓶颈往往不在单卡算力,而在网络通信。分布式训练和推理中,集合通信、参数同步和模型并行流量一旦超过网络带宽,整个集群就会变成通信受限状态。因此,思科的800G光互连和Silicon One网络架构在这套配置中扮演的角色,远不止“配件”那么简单。
软件层面同样值得留意。AMD在2027年扩产阶段明确纳入ROCm软件栈。对于正在评估跨平台迁移能力的团队而言,这意味着AMD正在推动ROCm从“可选”走向“标配”。
(素材来自:AMD/思科 智算芯能前沿网综合)
本文由智算芯能前沿网编辑整理,转载请注明出处。
