近日的特斯拉AI日活动上,特斯拉公布了最新的AI训练芯片“D1”,规模庞大,令人称奇。
该芯片采用台积电7nm工艺制造,核心面积达645平方毫米,仅次于NVIDIA Ampere架构的超级计算核心A100(826平方毫米)、AMD CDNA2架构的下代计算核心Arcturus(750平方毫米左右),集成了多达500亿个晶体管,相当于Intel Ponte Vecchio计算芯片的一半。
其内部走线,长度超过11英里,也就是大约18公里。
它集成了四个64位超标量CPU核心,拥有多达354个训练节点,特别用于8×8乘法,支持FP32、BFP64、CFP8、INT16、INT8等各种数据指令格式,都是AI训练相关的。
特斯拉称,D1芯片的FP32单精度浮点计算性能达22.6TFlops(每秒22.6万亿次),BF16/CFP8计算性能则可达362TFlops(每秒362万亿次)。
为了支撑AI训练的扩展性,它的互连带宽非常惊人,最高可达10TB/s,由多达576个通道组成,每个通道的带宽都有112Gbps。
而实现这一切,热设计功耗仅为400W。
特斯拉D1芯片可通过DIP(Dojo接口处理器)进行互连,25颗组成一个训练单元(Training Tile),而且多个训练单元可以继续互连,单个对外带宽高达36TB/s,每个方向都是9TB/s。
如此庞然大物,耗电量和发热都是相当可怕的,电流达18000A,覆盖一个长方体散热方案,散热能力高达15kW。
特斯拉展示了实验室内部的一个训练单元,运行频率2GHz,计算性能最高9PFlops(每秒9千万亿次)。
特斯拉还用D1芯片,打造了一台AI超级计算机“ExaPOD”,配备120个训练单元、3000颗D1芯片、1062000个训练节点,FP16/CFP8训练性能峰值1.1EFlops(每秒110亿亿次计算)。
建成后,它将是世界上最快的AI超算,对比特斯拉现在基于NVIDIA方案的超算,成本差不多,但拥有4倍的性能、1.3倍的能效比、1/5的体积。
关键词: D1芯片 FP32单精度浮点计算性能 特斯拉 AI训练芯片
凡注有"环球传媒网"或电头为"环球传媒网"的稿件,均为环球传媒网独家版权所有,未经许可不得转载或镜像;授权转载必须注明来源为"环球传媒网",并保留"环球传媒网"的电头。
- 今日快讯:感恩老师的精品图片推荐 感恩教2022-06-14
- 最新资讯:lol英雄排名 LOL史上十大最强英2022-06-14
- 快资讯丨右脑型思维者 你们是属于左脑还是2022-06-14
- 热门:母乳喂养大本营 乳汁是这样分泌的2022-06-14
- 【快播报】见男友的小tips 突然火起来的见2022-06-14
- 今日播报!环保小制作图片 牛奶盒盒子都有2022-06-14
- 今日报丨闭嘴用英文怎么说?“闭嘴”再用shu2022-06-14
- 每日精选:苍蝇怎么驱赶有效?苍蝇怕什么?苍2022-06-14
- 每日视讯:卡多雷风铃是什么?风铃花简单介2022-06-14
- 精选!55bbs我爱购物网怎么样?免费二级域名2022-06-14
- 今日视点:低音炮功放有哪些?低音炮功放板2022-06-14
- 要闻速递:二战国语电影有哪些值得看?免费2022-06-14
- 快播:梁颖和罗冠军(梁颖罗冠军照片)2022-06-14
- 每日速读!qq密码多少位?qq密码一般是几位数2022-06-14
- 为什么有人吃蓝莓舌头不变黑?为什么吃蓝莓2022-06-14
- 涌泉艾灸一次多长时间 艾灸灸涌泉可以祛湿2022-06-14
- 幸媛情感学苑挽回婚姻怎么样,真实修复案例2022-06-14
- 燕窝早吃和晚吃的区别 吃燕窝有什么忌口或2022-06-14
- 燕窝的口感什么样最好 燕窝没有炖熟吃了2022-06-14
- 燕窝适合什么样的人群使用 为什么爪哇燕窝2022-06-14
- 泡脚时出现心慌心悸 泡脚胸闷气短是怎么回2022-06-14
- 大燕条和燕盏哪个好? 燕盏和燕碎的营养区2022-06-14
- 家里的艾草能直接泡脚吗?艾叶为什么不能2022-06-14
- “永远跟党走,喜迎二十大 ”将军笔会在昆2022-06-14
- 燕窝炖出来有霉味是什么原因 燕窝为什么有2022-06-14
- 热门:蹦迪基础舞步分享学习 蹦迪入门动作2022-06-14
- 每日短讯:妮可里奇是什么?2020妮可里奇街拍2022-06-14
- 重点聚焦!淡菜怎么洗?淡菜怎么洗最干净最方2022-06-14
- 【速看料】用路由器上不了网怎么办?无线路2022-06-14
- 当前看点!电驴不能用了 电驴网络显示未连2022-06-14