设为首页
收藏本站
切换到宽版
门户
Portal
社区
BBS
站长
开发
运维
资源
游戏
产品
登录
立即注册
随客社区
»
社区
›
社区协作
›
新闻资讯
›
华为开源5050亿参数openPangu-2.0-Pro模型,权重与推理 ...
返回列表
发布新帖
查看:
2
|
回复:
0
[人工智能]
华为开源5050亿参数openPangu-2.0-Pro模型,权重与推理代码同步开放
JQR1
JQR1
当前离线
UID
9
星火
贡献
奖金
发表于
4 小时前
|
查看全部
|
阅读模式
这里或许是互联网从业者的最后一片净土,随客社区期待您的加入!
您需要
登录
才可以下载或查看,没有账号?
立即注册
×
本帖最后由 JQR1 于 2026-7-31 14:18 编辑
7月31日,华为正式开源盘古AI模型品牌openPangu旗下openPangu-2.0-Pro大模型,同步开放模型权重、基础推理代码及技术报告,进一步推进昇腾AI生态建设,为开发者和企业提供基于昇腾原生训练与推理技术的最佳实践。
据了解,openPangu-2.0-Pro是一款基于昇腾NPU训练的大规模混合专家(MoE)语言模型,总参数规模约505B(5050亿),每Token激活参数约18B,支持512K上下文长度,训练数据规模约34T Tokens。在后训练阶段,模型完成了快慢合一监督微调(SFT)、多专项强化学习(RL),并通过在线蒸馏(OPD)实现能力融合,进一步提升综合性能。
此次开源是华为openPangu2.0开源计划的重要组成部分。今年6月举行的HDC2026开发者大会上,华为常务董事、产品投资评审委员会主任、终端BG董事长余承东宣布,openPangu2.0将自6月30日起陆续开源7大组件,包括预训练代码、后训练代码和训练算子等核心能力。此前,92B参数的openPangu-2.0-Flash模型已于6月30日率先开源。
针对openPangu-2.0-Pro总参数规模为505B,余承东曾表示,华为将大量AI算力资源支持国内产业生态,自身可用算力相对有限,同时AI训练成本持续高企,因此华为更注重模型在时延、吞吐率等推理效率上的优化。随着openPangu2.0持续开放核心模型与训练能力,昇腾原生AI开发生态有望进一步完善,并为国产大模型研发提供更多开源参考。
Ascend Tribe开源社区:
https://www.huaweicloud.com/product/modelarts/studio
来源:
AIbase
回复
举报
返回列表
发布新帖
高级模式
B
Color
Image
Link
Quote
Code
Smilies
您需要登录后才可以回帖
登录
|
立即注册
本版积分规则
发表回复
回帖后跳转到最后一页
快速入口
社区门户
社区首页
随客云计算
重要文档
社区规则
官方公告
关于我们
团队介绍
产品合集
联系我们
532352
028-67879779
tech@isuike.com
Copyright © 2001-2026
Suike Tech
All Rights Reserved.
随客交流社区 (备案号:
津ICP备19010126号
)
|
Processed in 0.123766 second(s), 7 queries , Gzip On, MemCached On.
关灯
在本版发帖
返回顶部
快速回复
返回顶部
返回列表