近日,国内领先的AI智算网络互联芯片设计企业——成都恒瀚微电子有限公司(以下简称“恒瀚微”)宣布完成近亿元人民币天使轮融资。本轮由北京国泰、成都科创投、成都高新创投、中信聚信投资,汇聚了市场化创投、地方科创引导与产业资本多重力量。这是国产高性能RDMA智能网卡赛道罕见的天使轮重磅融资,也是资本市场对国产AI算力互联底层硬科技投资价值的重要信号。融资资金将主要用于高性能RDMA智能网卡产品的研发迭代、核心人才引进与市场拓展,加速国产AI算力互联基础设施的产业化落地。

当前,随着AI训练集群加速向万卡级乃至更大规模演进,节点间网络互联性能的重要性持续提升。AI集群算力能否充分释放,关键已从单一GPU的芯片算力,转向节点间网络互联性能。在数据并行、张量并行、流水线并行等分布式训练中,海量数据在GPU间高速流动,网络带宽不足、传输时延与拥塞丢包,将直接导致有效算力的大幅折损。业界将这部分被网络通信、存储和虚拟化等底层开销“吃掉”的算力称为“数据中心税”,在大型集群中可吞噬高达30%的系统资源。网络互联,正在成为决定集群算力效率上限的核心瓶颈。

RDMA(Remote Direct Memory Access,远程直接内存访问)技术正是破解这一瓶颈的关键。不同于传统网络通信需经过操作系统内核协议栈的多次拷贝处理,RDMA允许一台计算机直接读写远端内存,绕过CPU和操作系统,实现微秒级低时延、高带宽的数据传输,同时大幅释放CPU算力用于核心计算任务。在AI训练集群、高性能计算和分布式存储等场景中,RDMA智能网卡已成为不可或缺的核心基础设施组件。

然而,高性能RDMA智能网卡市场长期被NVIDIA(Mellanox)等海外厂商主导,尤其在面向AI推理与训练的高端领域,海外厂商凭借芯片设计、协议栈和软件生态的先发优势占据主导地位。其中NVIDIA凭借Connect-X系列与CUDA生态的深度绑定,在AI智算场景下市占率高达95%。在芯片出口管制与算力基础设施自主可控的大趋势下,以NVIDIA CX7为代表的高端RDMA智能网卡芯片对华出口周期已延长至平均6个月,国产RDMA智能网卡的替代需求日益迫切,自主可控的算力互联底座已成为保障国家AI产业安全发展的战略刚需。

恒瀚微坚持全栈自研,在Scale-out网络业务场景下,基于低资源、低功耗的结构化RDMA架构,创新性地采用包含主动拥塞控制机制在内的先进流量管控技术,在业内首发Credit-based AI网卡。恒瀚微AI网卡大幅降低拥塞流场景下的时延(动态时延),进一步保障带宽的稳定性,在性能、功耗与成本上形成了差异化竞争优势。在Scale-up网络业务场景下,恒瀚微可提供高性能、高可靠、低成本的GPU 互联定制化解决方案,用于构建可扩展GPU连接。目前基于Ethernet标准,每通道将提供双向100 GB/s的数据传输速率,根据客户需求,最高可支持双向1.2 TB/s GPU Scale-up带宽,GPU数量和带宽可灵活扩展,以满足 AI 应用的需求。

技术能力方面,恒瀚微首创Credit-based拥塞控制机制。在大规模GPU集群中,传统RDMA网络面临的首要挑战是“拥塞塌陷”——当多路并发流量同时抵达同一节点时,缓冲区溢出与重传风暴将导致尾延迟急剧恶化,集群有效吞吐量断崖式下跌。恒瀚微的Credit-based主动拥塞控制机制,通过信用体系实现流量级的精细化速率调控,从源头主动预防拥塞,而非被动丢包重传,在万卡及以上组网规模下有效保障低尾延迟与高稳定吞吐,这一能力直接决定了AI训练集群的实际算力利用率。

产品进展方面,恒瀚微400G RDMA智能网卡已完成客户送样并实现商业化,标志着国产高性能RDMA网卡在产业化落地上迈出关键一步。下一代超高带宽AI网卡芯片已进入最终定型阶段,对标NVIDIA CX8/9网卡芯片,将抢占即将爆发的800G/1.6T AI智算Scale-out互联市场。

此外,恒瀚微将融合Scale-out与Scale-up相关产品,基于CPO、OIO等先进光互联封装工艺,部署下一代结合硅光技术的ONIC网卡,推动未来Scale-mixed网络互联架构的发展。

本轮融资的资本结构覆盖市场化创投、地方科创引导与产业资本多重力量,体现了各方对恒瀚微技术路线、团队能力及商业化前景的高度认可。多家机构的联合加持,将为企业加快研发迭代、拓展头部客户与完善产业生态提供充足弹药。值得注意的是,四家投资方中既有北京国泰创投这样的市场化创投机构,也有成都科创投、成都高新创投这样的地方国资平台,还有中信聚信这样的产业资本团队,多元资本结构为后续融资与资本市场对接打下了多维度基础。

本文由智算芯能前沿网编辑整理,转载请注明出处。