浪潮AI服务器大幅提升NLP模型Transformer训练性能
2019-09-12 17:05:14爱云资讯631
近日,在北京举行的2019人工智能计算大会(AICC 2019)上,浪潮发布主流自然语言处理(NLP)模型Transformer的最新性能测试数据。Transformer模型参数规模可达数亿,对计算、通信的要求非常高。性能数据显示,相比同类服务器,浪潮AI服务器NF5488M5大幅提升了Transformer的训练性能,GLUE基准训练至80.4%的时间相比同类产品大幅减少67%。

浪潮AI服务器NF5488M5
人工智能正在由“能看、会听”的感知智能向“能读、会写”的认知智能迈进。由于文字是信息、思想的重要载体,如果计算机能够理解文字并能够用文字表达,那么就具备了读写能力,因而NLP被认为是认知智能的重要突破口。目前主流的NLP模型包括Transformer, Bert, GPT, XLNet等,而Bert和GPT都基于Transformer架构。Transformer被视为是NLP的经典模型,2017年由谷歌提出,其利用自注意力(self-attention)机制实现快速并行,并且可以增加到非常深的深度,充分发掘DNN模型的特性,提升模型准确率。
但是Transformer模型训练是一大难题,因为其参数规模达到数亿,对计算力的需求很大。OpenAI的Transformer模型有12层、768个隐藏单元,使用8块P100 GPU在8亿词量的数据集上训练40个Epoch需要一个月。背后的原因很大程度上在于GPU通信制约。Transformer Attention机制的全连接层计算时会产生海量参数,而更新参数梯度需要GPU间高速传输。同时,模型规模很大导致占用大量GPU显存,而batchsize通常都很小,导致每次计算的时间较快,计算后更新参数梯度频繁,这也进一步要求更高的GPU间传输速度。
浪潮AI服务器NF5488M5 通过无阻塞的GPU全互连设计,突破性地实现了All to All 300GB/s的Peer to Peer带宽。在当前深度学习通信模型All Reduce性能表现上,NF5488M5的实际通信带宽可以达到采用常规NVLink互联的GPU服务器的3倍以上。正是这种特性,大大提升了Transformer模型在NF5488M5上的通信效率,从而加大了计算通信比,节约了整体运行时间。测试结果表明,NF5488M5大幅提升了Transformer训练性能,GLUE基准训练至80.4%的时间比采用PCIe互联的8GPU服务器缩短67%,比采用常规NVLink互联的8GPU服务器缩短31%。

Transformer训练性能测试结果
浪潮集团AI&HPC总经理刘军认为,当前基于Transformer的Bert, XLNet等模型代表了NLP的发展方向,而它们的特点就是加速器间通信制约。测试结果充分表明浪潮AI服务器NF5488M5在GPU间通信效率上具有显著领先优势,能够大幅提升Transformer等大型AI工作负载的训练性能,降低训练成本,加速认知智能研发和应用落地。
浪潮是人工智能计算的领导品牌,AI服务器中国市场份额保持50%以上,并与人工智能领先科技公司保持在系统与应用方面的深入紧密合作,帮助AI客户在语音、语义、图像、视频、搜索、网络等方面取得数量级的应用性能提升。浪潮与合作伙伴共建元脑生态,共享AI计算、资源与算法三大核心平台能力,助力行业用户开发并部署属于自己的“行业大脑”,加速推进产业AI化落地。
相关文章
- 引领大模型推理效率革命!浪潮存储发布国内首款推理加速存储AS3000G7
- 浪潮KaiwuDB 出席 2025 开放原子开源生态大会,开源社区项目挑战赛正式发布
- 数智浪潮奔涌青岛,华为中国政企用户峰会2025启幕在即
- 浪潮KaiwuDB 入选 Gartner DBMS “市场指南”及数据技术“成熟度曲线”双报告
- 浪潮KaiwuDB 受邀出席2025可信数据库发展大会,分享能源行业数据库应用创新
- 机器人替代机器:智库智能引领托盘仓储领域时代浪潮 ——专访江苏智库智能科技有限公司CEO 蔡传玉
- 传音控股本地化战略的跨区域成功:驱动东南亚、南亚数字化浪潮
- 浪潮KaiwuDB 连续三年入选中国信通院数据库产业图谱,持续筑牢可信数字底座
- 工业富联:AI浪潮中的“蜕变者”,下一个万亿巨头
- 中国工联院联合浪潮KaiwuDB 等单位编写《工业数据库规范》系列标准,推进工业数字底座建设
- 浪潮通信信息参编的TM Forum自智网络产业白皮书7.0发布
- AI浪潮下存储需求大增,江波龙以自研技术加速全产业链布局
- 医药数字化浪潮奔涌,新畅科技亮相第90届全国药品交易会引行业瞩目
- 浪潮瑶台预制模块化数据中心入选《中国-上海合作组织数字技术工具箱(2025)》
- 从“新三样”到空天地海,中国移动硬核科技矩阵引领AI+时代浪潮
- 来也科技发布多场景智能体矩阵,开启智能体规模化落地浪潮