第511章 处於领先全球的大气层!&好日子~(1 / 3)
正在为你同步最接近灵魂波长的故事。
AI自动续读
到达章尾后自动同步下一章
开启AI自动续读
抵达章尾后自动同步下一章,阅读不断流。
后者需频繁在显存与与计算单元间搬运权重数据,每叠代100步,便因数据搬运,浪费28秒。
而骄阳200可实现“数据不动计算动”,同等任务下,计算效率提升倍!
此外,通过骄阳200內置的“自注意力並行计算单元”,针对transformer的qkv矩阵乘法设计,可实现硬体级加速。
单卡每秒可处理万亿次注意力计算!
gtx680仅万亿次。
在在bert—base模型推理中,单卡qps,即每秒查询率达万!
是gtx680的倍!
功耗方面。
骄阳200的存算一体架构,使单卡功耗控制在220w,稍低於gtx680的195w。
但算力功耗比达
在7x24小时不间断运行的情况下,8卡骄阳200集群,年耗电量较gtx680集群减少120
万度!
集群扩展性方面。
基於洛先知亲自主导研发的“晶片间高速通信协议+“云—芯协同”协议+高速总线”三层技术架构,骄阳200实现了节点通信的代际跨越!
单集群可扩展至256卡! ↑↑