华为汪涛发布业界首个NPO超节点 这次发布里我比较想聊的,是业界首个采用NPO技术的昇腾960超节点。
最近几年大家聊AI算力,最容易注意到的还是芯片有多少卡、峰值算力有多高。但集群规模真正上去以后,问题会变得很具体,几千张、几万张卡放在一起,彼此之间传数据够不够快,功耗压不压得住,机器能不能稳定跑,这些都会影响最后真正能用上的算力。
这次昇腾960超节点做到4096卡规模,里面一个挺有意思的变化,就是用5500个Hi-ONE替代原本需要的4.8万颗800G光模块。数字看着有点硬,但背后的逻辑不复杂,就是尽量让卡和卡之间传得更快,同时少耗一点电、少一些故障点。
所以现在再看AI基础设施,单看一颗芯片已经不太够了。芯片、互联、存储、内存、软件调度这些东西,最后都得放到一套系统里看。
大模型越做越大,真正难的也不只是「有没有足够多的卡」,而是这么多卡放在一起之后,能不能像一台机器一样高效工作。NPO这次被放到超节点里,至少说明行业已经开始认真解决这个问题了。


