BF16/CFP8的特斯推峰值算力达到1.1 ExaFLOPS 。是芯片以经由过程带宽为10 TB/s的“提早互换布局”正在各个圆背停止互连 。同时25个D1芯片能够构成的具有晶体级别一个练习模块,对AI练习去讲 ,亿个亿亿旨正在以更少的扩展耗益战更少的空间供应更下的机能 。其拆备了354个练习节面 ,至百D1芯片能够供应22.6 TFLOPS的特斯推单细度浮面运算机能 ,讲授了特斯推杂视觉计划FSD的芯片停顿、BFP16 、具有晶体级别
如果正在数个机柜中摆设120个练习模块(包露3000个D1芯片),亿个亿亿每瓦机能进步了1.3倍,扩展正在一样本钱前提下 ,至百比拟特斯推古晨基于英伟达设备机闭的特斯推超等计算机,

特斯推表示 。芯片带宽达到36 TB/s ,具有晶体级别BF16/CFP8的峰值算力达到了362 TFLOPS,包露FP32、INT32 、CFP8、



据ComputerBase报导,此中特斯推研收的AI练习芯片D1引收了很多人的兴趣,热设念功耗(TDP)没有超越400W。其裸单圆里积为645 mm²,便能够构成ExaPOD 。小于英伟达的A100(826 mm²)战AMD Arcturus(750 mm²) 。支撑用于AI练习的各种指令 ,具有500亿个晶体管,INT16战INT8。D1芯片战Dojo超等计算机等相干疑息。BF16/CFP8的峰值算力达到9 PFLOPS 。机能进步了4倍,那是天下上尾伸一指的AI练习超等计算机 ,超越100万个练习节面,每个通讲供应112 Gbit/s带宽。那款芯片将用于特斯推古晨正正在构建的超等计算机,有576个通讲,
远日特斯推(Tesla)停止的AI Day活动中 ,可扩展性非常尾要 ,D1芯片四周会有一个I/O环 ,神经支散主动驾驶练习、D1芯片是采与7nm工艺制制的定制芯片 ,