天垓100率先完成百亿级参数大模型训练,天数智芯迎来新的里程碑
2023-06-13 14:38:28爱云资讯1241
6月10日,在第五届智源大会AI系统分论坛上,上海天数智芯半导体有限公司(以下简称“天数智芯”)对外宣布,在天垓100加速卡的算力集群,基于北京智源人工智能研究院(以下简称“智源研究院”)70亿参数的Aquila语言基础模型,使用代码数据进行继续训练,稳定运行19天,模型收敛效果符合预期,证明天数智芯有支持百亿级参数大模型训练的能力。
图 天数智芯产品线总监宋煜
在北京市海淀区的大力支持下,智源研究院、天数智芯与爱特云翔共同合作,联手开展基于自主通用GPU的大模型CodeGen(高效编码)项目,通过中文描述来生成可用的C、Java、Python代码以实现高效编码。智源研究院负责算法设计、训练框架开发、大模型的训练与调优,天数智芯负责提供天垓100加速卡、构建算力集群及全程技术支持,爱特云翔负责提供算存网基础硬件及智能化运维服务。
图 天数智芯大模型训练全栈方案
在三方的共同努力下,在基于天垓100加速卡的算力集群上,100B Tokens编程语料、70亿参数量的AquilaCode大模型参数优化工作结果显示,1个Epoch后loss下降到0.8,训练速度达到87K Tokens/s,线性加速比高达95%以上。与国际主流的A100加速卡集群相比,天垓100加速卡集群的收敛效果、训练速度、线性加速比相当,稳定性更优。在HumanEval基准数据集上,以Pass@1作为评估指标,自主算力集群训练出来的模型测试结果达到相近参数级别大模型的SOTA水平,在AI编程能力与国际主流GPU产品训练结果相近。
图 基于天垓100算力集群的AquilaCode大模型训练性能采样
天垓100率先完成百亿级参数大模型训练,迈出了自主通用GPU大模型应用的重要的一步。这一成果充分证明了天垓产品可以支持大模型训练,打通了国内大模型创新发展的关键“堵点”,对于我国大模型自主生态建设、产业链安全保障具有十分重大的意义。
接下来,天数智芯将与合作伙伴们继续深入合作,建设更大规模的天垓100算力集群,完成更大参数规模的大模型训练,以自主通用GPU产品更好支持国内大模型创新应用,进一步夯实我国算力基础,助力人工智能产业自主生态建设。
相关文章
- 青云AI算力云上新 Qwen3-30B-A3B,大模型 API 一键调用
- 聚焦大模型训练效率提升 北大依托昇腾突破细粒度混合并行技术
- 智云健康AI大模型新突破,助力妊娠期糖尿病干预成果登国际顶刊
- 央国企大模型落地难题频现,科大讯飞知识工程平台何以破局?
- WAIC2025:澳鹏发布新一代技术平台矩阵 助力大模型垂直应用落地
- 值得买科技CTO王云峰出席WAIC 2025智谱大模型论坛:让模型能力在场景中兑现价值
- 科大讯飞以自主可控技术突破 加速定义国际大模型新生态
- 引领大模型推理效率革命!浪潮存储发布国内首款推理加速存储AS3000G7
- SuperCLUE测评榜单第一!骄阳·工业大模型正式发布
- 中国移动助力中国中化发布央企首个AI+农业种植领域大模型
- 2025中国互联网大会|大模型安全发展论坛暨中国电信第五届科技节·北京站成功举办
- 大模型品牌全新升级,京东JoyAI加速走向深度应用
- “光明大模型”领航能源革命——国家电网WAIC 2025展示AI赋能新型电力系统中国方案
- 亿咖通科技亮相2025世界人工智能大会,以舱驾融合领跑AI大模型应用市场
- 端侧大模型迎来“轻“革命:移远通信 × RWKV 打造“轻量AI大脑“
- 从智鑫多维到Agentic大模型:易鑫亮相WAIC彰显金融科技实力
人工智能技术
更多>>人工智能公司
更多>>人工智能硬件
更多>>- 技嘉 M27Q2 QD 高清2K 量子点电竞显示器正式上市
- 新型Xsens Avior OEM IMU,体积小、重量轻,可在苛刻的工作条件下提供高精度和高稳定性
- 从 “认知优势” 到现实赋能:DPVR AI Glasses 重构智能穿戴价值
- 韶音闪耀2025ChinaJoy:OpenDots ONE斩获黑金奖,引领开放聆听新风尚
- IBM调研报告:13%的企业曾遭遇AI模型或AI应用的安全漏洞
- 国内首证!驰芯半导体CX500车规级UWB SoC芯片通过FiRa Core 3.0认证
- 解锁AI新玩法 三星Galaxy Z Flip7带来升维的智能体验
- 昇腾赋能三维生成新突破!浙大团队实现跨模态可控3D CAD建模