华为盘古2.0,全栈开源

智东西 2026-09-28 17:53

华为盘古2.0,全栈开源图1

华为把盘古2.0训练代码开源了,基于昇腾集群。
作者 |  李水青
编辑 |  心缘
智东西9月28日报道,今日,华为宣布盘古大模型2.0开源版openPangu-2.0的预训练、SFT(监督微调)代码以及后训练RL(强化学习)代码正式开源上线。
华为盘古2.0,全栈开源图2
开源地址:
https://gitcode.com/ascend-tribe
openPangu Training Framework是面向大规模基础模型训练的统一训练框架,支持大语言模型、视觉语言模型以及多模态模型的训练与开发。框架提供从大规模预训练、监督微调到模型持续优化的一体化训练能力,支持多维分布式并行、高效数据流水线、混合精度训练、自定义算子优化以及高可用训练等能力。
华为盘古2.0,全栈开源图3
该仓库主要提供以下训练能力包括:预训练方面,支持基于大规模无监督语料从头训练基础模型,支持基于已有Checkpoint的持续训练,支持大规模分布式训练和长上下文训练。
监督微调方面,支持基于预训练模型进行指令对齐和能力增强,支持指令数据、多轮对话数据以及领域数据微调,支持参数高效微调和多任务训练。
openPangu-2.0-RL是面向华为昇腾的强化学习加速框架,以强化学习开源框架VERL为训练编排内核,通过运行时补丁与昇腾亲和优化,在昇腾集群上完成Actor(策略模型)/Rollout(样本生成)/Reward(奖励模型)协同训练。
华为盘古2.0,全栈开源图4
面向openPangu的GSPO(组序列策略优化)/GRPO(组相对策略优化)后训练,典型使用场景包括数学推理的单轮Rollout,以及面向推理的代码生成的多轮Rollout(ReAct,推理行动框架)。
此前,6月12日,华为常务董事、终端BG董事长余承东在华为开发者大会,并在会上提出“做全世界最好的盘古大模型”。
而后6月30日,总参数92B、激活参数6B的openPangu-2.0-Flash开源;7月31日,总参数505B、激活参数18B的。
根据其技术报告,openPangu-2.0系列融合自研硬件内核、整机系统架构、训推一体化智能体强化学习算法,专门为长上下文智能体任务打造。同时,盘古模型重点针对昇腾算力进行了优化,昇腾原生训练的训练效率提升了30%。
AtomGit的数据显示,截至今日,本地离线模型openPangu-2.0-Pro在该托管平台上下载量为8834次,openPangu-2.0-Flash下载量达到22068次。
华为盘古2.0,全栈开源图5
此前9月17日,在华为2026年全联接大会上,华为副董事长、轮值董事长汪涛宣布,华为AI战略的核心是算力,坚持硬件变现;构建开源开放的算力生态,支持主流大模型原生训练、积极拥抱“百模千态”;同时,将盘古大模型用于华为产品智能化,增强自身产品竞争力。
今日,华为进一步放出openPangu-2.0完整训练栈,是openPangu-2.0项目开源收官的关键一步。
华为盘古2.0,全栈开源图6
华为盘古2.0,全栈开源图7
华为盘古2.0,全栈开源图8
华为盘古2.0,全栈开源图9
华为盘古2.0,全栈开源图10

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
开源 华为
more
聚焦心脏健康:大型儿童医院将开源 NVIDIA AI 技术用于心脏疾病诊疗
阿里最新图像模型开源!视觉生成部分仅7B,能生透明图、能改图
估值156亿美元法律AI独角兽Harvey弃用闭源模型,转向中国开源方案以自救
开源王座易主?小米罗福莉发新模型:工程难度超DeepSeek-R1
罗福莉带小米登顶全球开源榜首!大规模RL立功,斩杀Grok 4.7
小米凌晨搞大事!MiMo-V2.6开源模型发布,超越 Kimi K3、GLM-5.3,而且不涨价
输出token永久免费!Jev爆火后,开源版也跟着火了
黄仁勋驳斥AI末日论:警惕恐慌阻碍产业落地,能源与开源成关键变量
日榜第二!北大开源,强化学习数据策略接入更简单、对比更公平
又一国产MoE旗舰模型登场!跻身全球开源第三,价格对标DeepSeek-V4-Pro
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号