设为首页收藏本站贵阳之窗

贵阳之窗

 找回密码
 立即注册

QQ登录

只需一步,快速开始

搜索
热搜: 贵阳 贵州 金阳
贵阳之窗 贵阳之窗 综合资讯 查看内容

浪潮信息助力淮海智算中心,千亿参数AI大模型训练算力效率超50%

2023-2-20 20:56| 发布者: 美通社| 查看: 2038| 评论: 0

北京2023年2月20日 /美通社/ -- 近日,淮海智算中心携手浪潮信息进行了超大规模参数AI大模型训练性能测试,实测数据表明,千亿参数规模的自然语言AI单体大模型在淮海智算中心计算平台上的训练算力效率达53.5%,刷新了业内AI大模型训练算力效率新高。这意味着淮海智算中心将可为国内生成式AI创新团队提供高性能、高效率的AI大模型训练算力服务。

生成式AI需要基于海量的自然语言或多模态数据集,对拥有巨大参数的超大规模AI模型进行训练,其训练所需AI算力当量非常高,如以PD(Petaflops-Day)为单位来衡量,OpenAI的GPT-3大模型训练的算力当量为3640PD,而浪潮"源1.0"大模型的算力当量则为4095PD。

超大规模AI大模型的训练一般必须在拥有成百上千加速卡的AI服务器集群上进行,如何在AI计算集群上获得更高的训练算力效率则会直接影响到模型训练时长以及算力消耗成本,这对于提升生成式AI研发创新效率有着非常重要的影响。据公开资料表明,GPT-3大模型在其V100 GPU集群上的训练算力效率为21.3%,而浪潮"源1.0"的训练算力效率则达到了44.8%。

针对AI大模型训练的计算特点,浪潮信息AI团队对淮海智算中心算力系统进行了专业设计,对集群架构、高速互联、算力调度等方面进行全面优化,在系统架构上,采用单节点集成8颗加速器的AI服务器,节点内加速器间实现超高速P2P通信,节点间建立极低延迟、超高带宽的Infiniband通信网络。在大模型训练技术层面,成功运用了中文巨量AI模型"源1.0"的训练优化经验,对分布式训练策略进行了针对性优化,通过合理设计张量并行、流水并行和数据并行,精准调整模型结构和训练过程的超参数,最终实现了千亿参数规模AI大模型的训练算力效率达到53.5%。

千亿参数AI模型结构及其实际性能表现
千亿参数AI模型结构及其实际性能表现

千亿参数AI模型结构及其实际性能表现

淮海智算中心由安徽省宿州市与浪潮共同推进建设,目标是建成技术先进、架构开放、应用丰富、生态完善的国内领先智算枢纽。淮海智算中心将依靠领先的算力、算法基础设施,开放的技术架构,成熟丰富的生态应用,面向全国提供智能算力、数据和算法服务,打造良好的智算产业生态。


鲜花

握手

雷人

路过

鸡蛋
最新聚焦
  • 痛心!中年男子患青光眼2年未在意 现右眼已
  • 平安财险毕节中心支公司深入乡村开展森林防
  • 平安财险遵义中心支公司深化党建共建 助力
  • 百度好奇嘉年华 9月18日邀您赢取千元大礼
  • 沿河县:黑水镇扎实开展高考和端午节期间道

LOGO下载|Archiver|手机版|小黑屋|联系我们|  

Copyright © 2014 本站仅为交流平台,所有内容均为网友投递或发布,本站对内容真实性不负任何保证,请网友自行查别。 版权所有  备案号:黔ICP备16010202号-1  Powered by Discuz!X3.2 Licensed

   
返回顶部