第292章 很多很多钱&谁来都是弟弟~(1 / 3)
正在为你同步最接近灵魂波长的故事。
AI自动续读
到达章尾后自动同步下一章
开启AI自动续读
抵达章尾后自动同步下一章,阅读不断流。
属於“样样通,样样松”。
不过当前的ai模型,处於百齐放的阶段,没有统一標准。
fpga加速卡可快速適配不同算法的特性,倒也算是契合当下的状態。
而极光自研的“骄阳10o”,则像是“lstm/transformer专属高速晶片”
直接跳过了“通用可编程”的路线,牺牲部分通用性,换取这两种模型的极致效率。
同样算力下,功耗更低,速度更快。
比如,训练一个语言模型时,同样的数据量,骄阳100的速度比cpu快10倍以上,比fpga快5倍以上!
且由於不需要像fpga那样“万能积木”式的通用电路,硬体更加精简,功耗至少可降低30%以上,大幅降低计算成本。
之所以选择这种极端路线,是因为洛川清楚的知道,这两种模型,正是未来ai大模型的核心。
transformer架构,更是大模型的核心底座!
当然,初代產品的性能,不论是算力,还是能效比、內存带宽等,都还远远不足以支撑超大规模分布式训练,仍需继续优化叠代。
不过倒是可以先搞一个“亿级参数模型”玩玩目前,他们已经在数据中心划出了独立集群,小规模部署骄阳100,適配极光云的特定业务,
以验证算力卡的实际性能。
如悠米视频的视频理解模型,悠米社区、极光微博的文本分类模型,微光基金的数据分析模型等等。
等世博会那边谈妥之后,也会单独构建一个模型。 ↑↑