9月28日,华为正式完成新一轮开源升级,全面开放开源盘古openPangu-2.0系列全套训练代码。本次上线资源涵盖预训练、监督微调以及后训练强化学习三大核心代码体系,相关内容已陆续同步至开源平台,面向全球科研人员、行业开发者与企业合作伙伴免费开放使用。

此次开源动作意义重大,标志着openPangu-2.0彻底完成从模型权重、推理能力到全流程训练体系的完整对外开放,彻底打通大模型研发、调优、迭代的全链路开源壁垒,为行业低成本研发高阶大模型提供了成熟可行的技术方案。

通用训练框架落地 支撑超大参数模型高效研发

本次同步开源的openPangu-2.0-Training,是一款适配大规模基础模型研发的统一训练框架,覆盖大模型全生命周期优化环节,包含海量数据预训练、精准监督微调、模型持续迭代优化等核心流程。

针对超大参数模型训练效率低、稳定性差的行业痛点,该框架集成多项前沿优化技术。平台原生支持多维分布式并行训练、自动化高效数据流水线、高精度混合精度训练模式,同时兼容自定义算子优化与高可用持续训练机制。整套架构可稳定支撑百亿级至万亿级参数基础模型的研发工作,为超大规模AI模型训练搭建起高性能、高可靠的底层基础设施。

昇腾原生强化学习框架 提升大模型自主任务能力

除通用训练框架外,华为同步推出适配昇腾平台的openPangu-2.0-RL强化学习加速框架。该框架依托成熟的VERL生态搭建而成,深度适配昇腾硬件体系,打造出原生适配的训练与部署一体化能力。

该框架主打智能体后训练强化学习优化,能够针对性弥补大模型在复杂场景的短板。通过专属强化学习训练机制,可有效提升openPangu系列大模型的逻辑推理、自主规划与闭环执行能力,让AI模型不再局限于基础问答,可适配更复杂的场景化任务落地,进一步贴合智能体时代的技术发展需求。

持续迭代更新 完善openPangu全栈开源生态

openPangu作为华为主打开源AI模型品牌,始终聚焦昇腾原生训练与推理技术研发,为行业AI落地提供标准化技术参考与实践范例。本次代码开源并非单次更新,而是华为持续迭代开源生态的重要一环。

早在2026年7月,华为已率先完成openPangu-2.0-Pro版本开源工作,对外释放5050亿参数模型权重、基础推理代码及完整技术报告,为行业提供了成熟的大模型推理落地方案。

随着本次训练、微调、强化学习全链路代码上线,openPangu-2.0已实现推理、权重、训练、调优、强化迭代的全维度开源,彻底补齐了大模型研发的技术闭环,为开发者提供一站式全栈研发工具。

深耕开源共建生态 持续迭代赋能产业AI升级

华为表示,开源生态的建设是长期持续的过程。后续团队将持续收集全球开发者与企业用户的使用反馈,针对框架性能、适配场景、训练效率等维度持续优化迭代,不断完善openPangu系列开源产品体系。

整套开源方案深度绑定昇腾硬件生态,兼顾通用性与专业性,既可以帮助科研团队快速开展大模型创新研究,也能助力企业降低AI模型自研门槛,加速各行业智能化、数字化转型进程,持续为通用人工智能产业发展注入开源动力。

(素材来自:华为 智算芯能前沿网综合)

标签:华为 AI模型

本文由智算芯能前沿网编辑整理,转载请注明出处。