超节点外 国产算力有这些新变化 系统级竞争范式转移
超节点外 国产算力有这些新变化 系统级竞争范式转移。走进2026世界人工智能大会(WAIC)H2算力主题展区,一整排像墙一样的黑色机柜映入眼帘。这是华为首次线下展示的昇腾950超节点真机,1024张NPU卡高速互联,能够提供1 EFLOPS FP8、2 EFLOPS FP4的澎湃算力。这一展示似乎宣告了一个系统级的算力时代到来。展馆里几乎所有算力厂商都推出了各自的超节点产品,如中科曙光展示了全国产十万卡AI超集群曙光8000(登峰)、中兴通讯发布了OEX超节点、沐曦股份展示了曦景S600超节点。整个WAIC 2026几乎被这些“大家伙”占领了C位。从单卡性能比拼到超节点系统的整体较量,国产算力正经历一场深刻的竞争范式转移。

摩尔线程高级副总裁董龙飞表示,算力处于供不应求状态,整个人工智能产业规模远大于互联网产业。他认为,投入打造的算力底座实际上是为未来十年、二十年搭建的新型数字基础设施。模型参数从千亿奔向数万亿,Agent应用将上下文窗口从256K推至1M甚至更高,推理和训练任务动辄横跨成百上千甚至上万张卡,超节点解决的是让这些卡更高效、更稳定地分工协作的问题。壁仞科技AI框架架构副总裁丁云帆也指出,AI的发展面临“超大参数、超长文本、超大集群”三大核心挑战,仅凭单张GPU的算力已无法独立应对,超节点因此成为市场的焦点。

超节点并不是简单地把芯片塞进机柜,其核心思路是放大纵向扩展范围,通过高带宽、低时延的互联方式将更多GPU紧密耦合,使它们如同一台超级计算机那样协同工作。首先需要打通的是通信瓶颈,超节点内GPU间需要高速交换设备互联,这也是超节点厂商着力攻克的技术难题。壁仞科技联合创始人、CTO洪洲表示,公司自研的BLinkTM2.0超节点互联协议,目标是实现“时延—带宽—可靠”端到端系统级协同。百度智能云混合云部总经理杜海介绍,百度智能云自研XPU-Link互联协议与可编程交换技术,支持从32卡扩展至最高1024卡。
所有文章未经授权禁止转载、摘编、复制或建立镜像,违规转载法律必究。
举报邮箱:1002263188@qq.com