华为昇腾中国市场份额超越英伟达 统一总线技术引领未来
|
在2026年9月17日召开的华为全连接大会上,华为轮值董事长徐直军与海思首席科学家廖恒博士共同出席了媒体问答环节,围绕面向人工智能时代的Peerium计算架构以及UnifiedBus(UB,灵衢总线)展开了深入交流。 回顾去年的全连接大会,徐直军曾发表主题演讲,正式发布昇腾芯片及其路线图(涵盖950、960、970,以及SuperPoD和SuperCluster),同时宣布开放UnifiedBus协议。今年的全连接大会上,华为进一步推出了昇腾950和Atlas 950 SuperPoD。尽管业界普遍在讨论SuperPoD或超级节点,但各厂商实现这些产品的路径存在显著差异。SuperPoD的核心目标在于让数千乃至数万个处理器协同工作,如同单台计算机一般运行。 Atlas 950 SuperPoD依托华为首创的新计算架构,目前已能实现让一百万个处理器像一台计算机一样工作。该架构命名为Peerium,通过嵌套并行、统一内存寻址和对等互连,达成了百万处理器级别的强扩展能力。它在图灵并行范式基础上引入了嵌套BSP(嵌套批量同步并行),同时对冯·诺依曼单机架构进行了扩展,突破了数十年来主从设计范式的主导地位。由于业界现有技术无法支撑这一架构,华为自主研发了关键互连技术——UnifiedBus。由此,一百万个处理器得以真正像一台更大型的计算机那样协同运行。 UnifiedBus是一种采用开放协议的高速总线,具备无限扩展能力,用于连接CPU、NPU、内存、SSD、接口卡和交换机。通过UnifiedBus,跨计算、存储和网络的对等互连得以实现,从根本上超越了传统的主从架构。Atlas 950 SuperPoD正是基于Peerium计算架构打造的产品。当前,一个搭载25.6万张计算卡的SuperCluster正在部署和测试之中。 以下为采访实录: 问:廖博士,您的论文提到了一款由25.6万张卡组成的SuperPoD。这是你们技术的上限吗?能否进一步谈谈市场对你们产品的需求? 廖恒回应称,25.6万这一数字并非随意选定。大型集群的用途在于训练,需要能够支撑基础模型训练的硬件基础设施,而当前基础模型已达到5万亿参数的规模。未来两年内,中国预计将有6到7家前沿AI实验室,它们都将致力于训练参数规模在10万亿至40万亿之间的基础语言模型。这些数字大致与内存容量和SuperPoD的规模相吻合。在中国,大多数数据中心在电网方面均有国家规划,因此20万是一个相对保守的估计。 问:你们有什么计划鼓励中国的模型提供商使用昇腾芯片进行训练? 徐直军表示,针对昇腾950,华为首先向市场推出了950PR,主要面向AI推理。基于昇腾950DT的SuperPoD则主要用于AI训练,目前正处于测试阶段,大规模供应预计将在今年年底或明年年初启动。华为正在与AI模型提供商进行广泛的沟通和讨论,使用昇腾950DT进行训练的测试结果相当理想。从明年起,大量AI模型训练将基于采用昇腾950DT的SuperPoD展开。 问:华为对美国领先AI模型提供商近期呼吁放缓AI开发有何看法? 徐直军认为,需要结合中国和美国AI发展的水平和节奏来看。中国的AI模型以开源为主,进展相对透明。美国的主流模型提供商拥有更多算力,因此只有他们自己清楚其模型的复杂程度处于何种水平。中国市场对AI风险的感知可能弱于美国。中国的模型提供商需要加快步伐,达到他们也能感受到AI发展风险的水平。需要在推动AI发展与管控AI风险之间取得平衡,确保AI向善。 问:华为是否有计划将Atlas 950 SuperPoD推向中国以外的其他市场?如果有,你们的目标市场是哪些?能否分享你们在中国市场份额的数据?你对中国推动芯片自给自足有何看法? 徐直军表示,由于产能不足,华为没有计划全面拓展国际市场,但确实有几个国家表现出非常强劲的需求。华为正在进行一些测试,并向这些国家提供部分供应,但数量相当有限。根据收集的数据,昇腾已经超越了英伟达。中国推动芯片自给自足是必然的前进道路,不会接受由他人决定是否能获得某些产品的未来。即使芯片不那么先进,至少供应是有保障的。 问:你们的UnifiedBus互连技术源自你们在计算和通信领域的长期优势。UnifiedBus有多少来自你们的网络部门? 徐直军解释,UnifiedBus不仅仅源自业务的网络部分,而是整合了不同的互连协议,开发出一个统一的协议。网络更多地与IP协议相关,延迟较高。计算互连更多地与总线相关,应提供低延迟和高速度。UnifiedBus由计算机架构师构思,但由网络团队养大。 问:UnifiedBus同时适用于横向扩展和纵向扩展,而英伟达分别用NVLink和InfiniBand应对这两种场景。那么华为将协议统一为一个UnifiedBus同时支持纵向和横向扩展,是出于什么考虑?与类似解决方案相比,UnifiedBus有哪些优势? 徐直军指出,英伟达最新的NVL72解决方案在机架内通信带宽高达1.8 TB/s,但一旦使用InfiniBand进行机架间通信,带宽降至0.2 TB/s。如此低的机架间通信带宽,无法让一百万个处理器像一台计算机一样工作。UnifiedBus可以在所有层级实现高速互连,基于UnifiedBus可以实现高达800 GB/s的机架间通信带宽。华为开发了搭载384个910C处理器的SuperPoD解决方案,已出货1000多套。廖恒补充说,单一协议可以减少协议转换开销,提高效率。 问:在采用UnifiedBus的Atlas 950 SuperPoD中,有多少纵向扩展是通过电信号实现的,有多少是通过光信号实现的?你认为光学最终会占据整个机架吗?最大的障碍是什么? 徐直军介绍,华为发布的Hi-ONE模块是一个NPO模块,支持7.2T带宽,距离主芯片仅5厘米。使用铜线连接这两者,其余全部是光学。华为能够开发和量产这个模块,是因为在光子学方面有多年的经验。廖恒提到,光学传输距离短、衰减小,但量产困难,因为温度变化会影响二极管的物理特性。最大的采用障碍是对可靠性的担忧。 问:你提到昇腾芯片在中国大陆的产能和供应有限。那么阻碍中国大陆产能提升的最大障碍是什么?到什么时候华为能够确保大规模稳定供应? 徐直军表示,瓶颈基本与全球相同,全球产业没有为AI激增做好准备。只有当供需达到平衡时,瓶颈才能解决。全球范围内的供需平衡将在2029年左右实现。在中国大陆,可能还会更慢。华为目前向市场的供应量已经可以称为“规模化供应”,但如果与AI基础设施的需求相比,仍然很少。 问:有报道称马来西亚正在考虑将华为昇腾910C加速器作为其主权AI计划的核心。你如何平衡国内和国外客户的需求? 徐直军表示,满足国内客户和国际客户需求之间的平衡很简单:优先考虑对算力有迫切需求的中国客户;在中国以外,只向非常有限的客户供应,这些客户要么无法获得替代解决方案,要么想要一个替代解决方案。 问:当华为决定选择NPO而非CPO时,华为内部最重大的反对意见是什么? 徐直军表示,华为内部似乎没有就此进行辩论。华为从事光器件、光模块和昇腾芯片,知道哪个是最佳选择。NPO在工程实施、成本、可维护性和良率等多个角度来看都是最佳选择。行业参与者也逐渐认识到NPO的好处,OIF的40家厂商现在都支持
|
论坛热帖
在线投稿
-
相关阅读
-
海南红树林保护区严查赶海违法行为,整改整治行动持续推进
-
一家六口带长辈赴喜宴返程 千里赴喜事归途伴团圆
-
美国女囚死刑执行失败后恢复意识 引发广泛争议
-
月薪一万五全上交老婆引热议 婚姻财务该谁管
-
孙颖莎发布会落座显露疼痛 遗憾止步32强
-
节后A股分红潮来了 多家公司大手笔派红包
-
央媒发声谈三大球振兴:不翻身不行,这条路任重道远
-
龙餐馆将角逐奥斯卡 战火中的温情故事引关注
-
入驻商铺
-
精彩图片
-
医生提醒:哈兰德狂人食谱不适合普通人,别盲目模仿
-
严重污染!印度首都河面漂浮大量有毒泡沫
-
金饰价格突破800元/克大关
-
绝美!北京朝霞遇到平流雾
-
美国给以色列派先遣队,援助的“萨德”也将启用?
-
以总理住宅遭无人机袭击 以方反应强烈
-
美政府紧急调查以色列报复伊朗计划外泄事件
-
以军袭击加沙地带北部拜特拉希亚地区已致73人死亡
-
新帖速递
-
海南红树林保护区严查赶海违法行为,整改整治行动持续推进
-
一家六口带长辈赴喜宴返程 千里赴喜事归途伴团圆
-
美国女囚死刑执行失败后恢复意识 引发广泛争议
-
月薪一万五全上交老婆引热议 婚姻财务该谁管
-
孙颖莎发布会落座显露疼痛 遗憾止步32强
-
节后A股分红潮来了 多家公司大手笔派红包
-
央媒发声谈三大球振兴:不翻身不行,这条路任重道远
-
龙餐馆将角逐奥斯卡 战火中的温情故事引关注


精彩评论文明上网理性发言,请遵守评论服务协议
共0条评论