特斯拉发布D1 AI芯片:500亿晶体管、400W热设计功耗
2021-08-22 21:20:28爱云资讯
近日的特斯拉AI日活动上,特斯拉公布了最新的AI训练芯片“D1”,规模庞大,令人称奇。
该芯片采用台积电7nm工艺制造,核心面积达645平方毫米,仅次于NVIDIA Ampere架构的超级计算核心A100(826平方毫米)、AMD CDNA2架构的下代计算核心Arcturus(750平方毫米左右),集成了多达500亿个晶体管,相当于Intel Ponte Vecchio计算芯片的一半。
其内部走线,长度超过11英里,也就是大约18公里。
它集成了四个64位超标量CPU核心,拥有多达354个训练节点,特别用于8×8乘法,支持FP32、BFP64、8、INT16、INT8等各种数据指令格式,都是AI训练相关的。
特斯拉称,D1芯片的FP32单精度浮点计算性能达22.6TFlops(每秒22.6万亿次),BF16/8计算性能则可达362TFlops(每秒362万亿次)。
为了支撑AI训练的扩展性,它的互连带宽非常惊人,最高可达10TB/s,由多达576个通道组成,每个通道的带宽都有112Gbps。
而实现这一切,热设计功耗仅为400W。
特斯拉D1芯片可通过DIP(Dojo接口处理器)进行互连,25颗组成一个训练单元(Training Tile),而且多个训练单元可以继续互连,单个对外带宽高达36TB/s,每个方向都是9TB/s。
如此庞然大物,耗电量和发热都是相当可怕的,电流达18000A,覆盖一个长方体散热方案,散热能力高达15kW。
特斯拉展示了实验室内部的一个训练单元,运行频率2GHz,计算性能最高9PFlops(每秒9千万亿次)。
特斯拉还用D1芯片,打造了一台AI超级计算机“ExaPOD”,配备120个训练单元、3000颗D1芯片、1062000个训练节点,FP16/8训练性能峰值1.1EFlops(每秒110亿亿次计算)。
建成后,它将是世界上最快的AI超算,对比特斯拉现在基于NVIDIA方案的超算,成本差不多,但拥有4倍的性能、1.3倍的能效比、1/5的体积。
- 2022年服贸会特斯拉展台成热门打卡点,解锁全新智能生活方式
- 集度汽车机器人新物种出现,号称智能水平领先特斯拉Model Y一代
- 连珠合璧!vivo宣布与特斯拉完成无感车钥匙适配
- 奔驰、特斯拉、毫末智行们的自动驾驶使命:不止“代驾”,更为“安全”
- 特斯拉去年中国市场营收138亿美元,连续两年增速超100%
- 特斯拉全自动驾驶 FSD Beta 10.9 推送:无保护左转弯更自然
- 特斯拉发布D1 AI芯片:500亿晶体管、400W热设计功耗
- 特斯拉AI DAY:AI神经网络解读 Dojo超算信息/AI机器人发布
- 正式下战书!马斯克宣称特斯拉将成为世界级AI公司“领头羊”
- 脑机接口是Hologram AR场景应用的重大机会,特斯拉/微美全息等5G+AI成主流技术
- 苹果/特斯拉/微美全息等AI视觉技术公司欲打造自动驾驶产业链
- 特斯拉有望4个月内推出完全自动驾驶服务 预计月费超100美元
- 特斯拉中国总裁朱晓彤证实将推出更便宜车型:针对中国市场设计
- 分析师:苹果Apple Car成特斯拉最大的竞争对手
- 特斯拉不孤单!moto edge s真相定价引爆手机圈,1999元起
- 特斯拉联手三星自研5nm芯片 应用于自动驾驶