燧原科技亮相Hot Chips大会,详解邃思芯片架构
2021-08-25 11:26:54AI云资讯1641

燧原科技第一代通用人工智能训练芯片“邃思1.0”封装示意图
邃思1.0是燧原科技2019年12月发布的第一代云端AI训练芯片,采用众核结构,其计算核心采用了燧原科技自研的GCU-CARE计算引擎。整个SOC拥有32个GCU-CARE计算引擎,组成4个计算群组,全面支持常见AI张量数据格式(FP32/FP16/BF16, INT8/INT16/INT32),更全面地支撑客户业务。CARE还创新地通过复用张量核心,用更有效的晶体管效率提供了标量、向量、张量以及多种数据精度的计算能力。
GCU-DARE数据架构,面向数据流优化,在数据流动中进行处理。512GB/s的HBM和200GB/s的GCU-LARE互联,数倍于传统GPU、CPU;强劲的分布式片上共享缓存,提供10TB/s的超大带宽;可编程共享缓存,可控线程内、线程间数据常驻共享,消除不必要的IO访问,既降低了数据访问延时,又节约了宝贵的IO带宽;同时,DARE架构还提供数据异步加载接口,支持数据与运算的流水执行,提高运算并行度。
四路GCU-LARE智能互联,200GB/s的高速低延时片间互联接口,灵活支持不同规模的计算需求,可支持千卡级规模集群,为大中小型数据中心提供基于不同需求的人工智能训练产品组合。

“邃思1.0”SOC
邃思1.0人工智能加速芯片专为云端训练场景设计,支持CNN、RNN、LSTM、BERT等常用人工训练模型,可用于图像、流数据、语音等训练场景。采用标准PCIe 4.0接口,广泛兼容主流AI服务器,可满足数据中心大规模部署的需求,且能效比领先。
演讲的最后部分,刘彦还介绍了上个月刚刚在世界人工智能大会上发布的“邃思2.0”训练芯片。经过全新升级迭代后,邃思2.0的计算能力、存储和带宽、互联能力较第一代训练产品有巨大提升,对超大规模的模型支持能力获得显著增强。由此,燧原科技成为国内首家发布第二代人工智能训练产品组合的公司。
邃思2.0进行了大规模的架构升级,针对人工智能计算的特性进行深度优化,夯实了支持通用异构计算的基础;支持全面的计算精度,涵盖从FP32、TF32、FP16、BF16到INT8,单精度FP32峰值算力达到40 TFLOPS,单精度张量TF32峰值算力达到160 TFLOPS。同时搭载了4颗HBM2E片上存储芯片,高配支持64 GB内存,带宽达1.8 TB/s。GCU-LARE也全面升级,提供双向300 GB/s互联带宽,支持数千张云燧CloudBlazer加速卡互联,实现优异的线性加速比。

燧原科技第二代通用人工智能训练芯片“邃思2.0”
而同步升级的驭算TopsRider软件平台,成为燧原科技构建原始创新软件生态的基石。通过软硬件协同架构设计,充分发挥邃思2.0的性能;基于算子泛化技术及图优化策略,支持主流深度学习框架下的各类模型训练;利用Horovod分布式训练框架与GCU-LARE互联技术相互配合,为超大规模集群的高效运行提供解决方案。开放升级的编程模型和可扩展的算子接口,为客户模型的优化提供了自定义的开发能力。
关于燧原科技
燧原科技专注人工智能领域云端算力平台,致力为人工智能产业发展提供普惠的基础设施解决方案,提供自主知识产权的高算力、高能效比、可编程的通用人工智能训练和推理产品。其创新性架构、互联方案和分布式计算及编程平台,可广泛应用于云数据中心、超算中心、互联网、金融及政务等多个人工智能场景。
燧原科技携手业内国际标准组织,秉承开源开放的宗旨,与产业伙伴一起促进人工智能产业发展。
相关文章
- MUNIK秒尼科助力芯海科技BMS芯片CBM9680获ASIL-B功能安全认证
- 硬科技突围:一颗中国芯片,如何破解AI算力的“存储墙”难题?
- 得一微AI存力芯片,闪耀湾区及深圳创新大奖
- 苹果、高通、联发科重点改进架构、扩展内存缓存,布局2纳米芯片,而先进制程已难引起消费者关注
- 台积电或将取消苹果优先发货的待遇,因手机芯片已非首要营收来源
- 马斯克全力出击芯片制造,AI5芯片性价比远超英伟达Blackwell
- AI芯片技术演进的双轨路径:从通用架构到领域专用的并行演进
- 联发科即将推出天玑9600芯片,预计采用LPDDR6内存和台积电N2P制程工艺
- 天玑 9500s芯片满配不妥协,旗舰体验同档无敌!
- 联合动力与纳芯微深化联合创新,定制芯片方案在第五代电控产品实现量产
- OpenAI将推出搭载三星2纳米Exynos芯片的无线耳机,自研Titan专用芯片预计年底问世
- 苹果自研服务器芯片据称将于2026年下半年投入量产
- 台积电芯片需求火爆,客户为确保订单愿意支付高达100%的溢价
- 受内存短缺涨价影响,存储芯片封装与测试企业也宣布提价30%
- 光本位科技研发出玻璃光计算芯片,算力有望超传统AI推理芯片的千倍
- 三星与高通合作,采用2纳米GAA工艺制造第五代骁龙8至尊版芯片
人工智能企业
更多>>人工智能硬件
更多>>- 首款 AMD 锐龙 AI Max+395 一体机!SEAVIV希未 AideaONE R27 2T+128GB 豪奢内存,秒级响应性能拉爆!
- 新版梵想S790评测:升级英韧IG5222主控,功耗降低性能提升
- 从追赶到定义:全球复合机器人产业格局与中国领跑之路
- 直击奢侈品仓储履约痛点!极智嘉三度携手雷诺斯,AI机器人方案成最优解
- 奢音S5耳夹耳机全新上市:以无感舒适,开放式耳机新体验
- 领跑全景相机赛道!大疆 Osmo360 凭硬核实力,拿下53.6%市场份额
- Dell PowerScale嵌入式元数据支持:让文件存储像对象存储一样智能
- 三星Galaxy Z Flip7奥运特别版震撼发布,助力奥运选手2026年冬奥之旅









