日前,在上海华为全联接大会上,徐直军和海思首席科学家廖恒一起,分享刚发布的Peerium计算架构,还有那套叫灵衢总线(UnifiedBus)的互联方案。

图源:华为官网
超节点,是今年各家算力厂商说的很多的一个词了。徐直军指出,如今大家都喊超节点,实现的法子却天差地别,硬仗是怎么把几千、几万颗处理器塞进同一台计算机里协同干活。华为给这套新架构起了个名字叫Peerium,目标是让上百万颗处理器像一台机器那样转起来。
华为正在搭、也在测的,是25.6万张卡规模的Atlas 950 SuperPoD超节点。二十五万张卡,听着像个夸张的数,可是放到廖恒后面的判断里,这个数反而显得克制了。
对此,海思首席科学家廖恒给了一个时间表,往后两年里,国内大概会冒出六到七个冲在前面的AI实验室,它们想训的模型,参数落在十万亿到四十万亿之间。
这类模型的胃口,其实正好和超节点的内存容量、规模对得上,所以才需要这么大的一摊基础设施来喂。这么看,华为铺的这些卡,是给那些真要炼重模型的实验室备着的。
算力芯片方面,昇腾950这次出了两个版本,PR和DT。PR在今年一季度就上市了,主打推理。DT 那颗是训练用的,配套的超节点还在测,大规模供货得到今年底或者明年初。廖恒透露,华为跟各家模型厂聊得很密,从眼下的测试结果看,950DT的训练表现相当能打。他的判断是,明年开始,大量模型的训练会落在 950DT超节点上面。
徐直军说,往后关键可能不在技术,而是在华为能供多少货。能产多少就供多少,他希望产业链赶紧把产能拉起来,快一点,多产一点。
这句话换个角度理解,它等于承认,华为眼下卡住的已经越过技术这一关,发愁的是做出来以后供不供得上。昇腾现在满足国内需求都还差得远,所以暂时没打算全面铺海外市场,只有少数几个国家做过测试和少量供给。
至于英伟达在中国市场的位置,他说很难用一个口径统计清楚。不过按华为自己能看到的那些数据,昇腾应该已经跑到英伟达前面去了。从中大概也能品出华为当下在国内算力供给上的底气。
把快一点多产一点这句话放在整个半导体语境里看,才明白它重在哪里。昇腾的芯片制造并不完全由华为自己掌控,先进封装和产能爬坡都要靠外部链条来配合。
整场下来,技术叙事反而不是重点。Peerium 把百万芯片捏成一台机器,Atlas 950 在测二十五万张卡,这些当然硬。可是徐直军把话题落到的地方,始终是产能和供给。
(来源:维科网)








