天垓100率先完成百亿级参数大模型训练,天数智芯迎来新的里程碑
2023-06-13 14:38:28AI云资讯1346
6月10日,在第五届智源大会AI系统分论坛上,上海天数智芯半导体有限公司(以下简称“天数智芯”)对外宣布,在天垓100加速卡的算力集群,基于北京智源人工智能研究院(以下简称“智源研究院”)70亿参数的Aquila语言基础模型,使用代码数据进行继续训练,稳定运行19天,模型收敛效果符合预期,证明天数智芯有支持百亿级参数大模型训练的能力。
图 天数智芯产品线总监宋煜
在北京市海淀区的大力支持下,智源研究院、天数智芯与爱特云翔共同合作,联手开展基于自主通用GPU的大模型CodeGen(高效编码)项目,通过中文描述来生成可用的C、Java、Python代码以实现高效编码。智源研究院负责算法设计、训练框架开发、大模型的训练与调优,天数智芯负责提供天垓100加速卡、构建算力集群及全程技术支持,爱特云翔负责提供算存网基础硬件及智能化运维服务。
图 天数智芯大模型训练全栈方案
在三方的共同努力下,在基于天垓100加速卡的算力集群上,100B Tokens编程语料、70亿参数量的AquilaCode大模型参数优化工作结果显示,1个Epoch后loss下降到0.8,训练速度达到87K Tokens/s,线性加速比高达95%以上。与国际主流的A100加速卡集群相比,天垓100加速卡集群的收敛效果、训练速度、线性加速比相当,稳定性更优。在HumanEval基准数据集上,以Pass@1作为评估指标,自主算力集群训练出来的模型测试结果达到相近参数级别大模型的SOTA水平,在AI编程能力与国际主流GPU产品训练结果相近。
图 基于天垓100算力集群的AquilaCode大模型训练性能采样
天垓100率先完成百亿级参数大模型训练,迈出了自主通用GPU大模型应用的重要的一步。这一成果充分证明了天垓产品可以支持大模型训练,打通了国内大模型创新发展的关键“堵点”,对于我国大模型自主生态建设、产业链安全保障具有十分重大的意义。
接下来,天数智芯将与合作伙伴们继续深入合作,建设更大规模的天垓100算力集群,完成更大参数规模的大模型训练,以自主通用GPU产品更好支持国内大模型创新应用,进一步夯实我国算力基础,助力人工智能产业自主生态建设。
相关文章
- 开启品牌评估智能模式:元景品牌价值人工智能大模型重磅发布
- 小鹏科技日:第二代VLA大模型与三大具身智能产品齐发 勾勒物理AI未来出行新图景
- 大模型+反诈+算力三重突破 腾讯云三项成果闪耀金融科技应用场景大赛
- 小鹏第二代VLA发布:首个量产物理世界大模型 智驾再进化
- 佳都科技三季报盈利态势稳续,研发赋能AI交通大模型
- 从典型应用到行业标杆,宜兴“天机镜”大模型将于11月5日 诠释城市安全治理新未来
- 产业AI大模型万联摩尔上线,从“通用”到“专用”的必然路径
- 云从科技入选大模型一体机产业图谱 以全栈能力推动AI落地新范式
- 百度王海峰:通用大模型与场景大模型相辅相成 并非割裂
- “工具”到“伙伴”:科大讯飞展示大模型如何助力教育减负增效
- 升级版“蓝心小V”亮相,豆包大模型助力vivo打造AI原生体验
- 讯飞星火燎原86届教装展,全栈自主可控国产教育大模型助推教育数字化转型
- 京东11.11直播技术全面升级,立影3D技术、JoyAI大模型重构沉浸式购物体验
- 云知声AGI落地智慧生活:推出“智能拍学机”等多款“智能硬件+大模型”解决方案
- 128 卡 4 天时间!百度百舸助力 LLaVA-OneVision-1.5 刷新多模态大模型训练效率纪录
- AI防护,与时俱进:信通院X电子科大X腾讯云共话大模型安全









