角力算力比拼,超节点成新“大国重器——2026世界人工智能大会观察

李治国 2026-07-20 14:52:27

7月的上海,黄浦江畔热浪与智能浪潮交相辉映,以“智能伙伴 共创未来”为主题的2026世界人工智能大会(WAIC2026)举行。1100多家企业参展,仅算力赛道参展企业就超过200家。记者连日探馆发现,一个显著变化悄然发生:硬核算力企业已不再“秀单颗芯片”,而是竞相“秀机柜、秀集群”。这些算力集群,正成为支撑我国通用大模型训练、推理的算力“大国重器”。

超节点:推倒芯片协同的“围墙”

步入展馆核心区,华为昇腾950超节点(Atlas 950 SuperPoD)真机首发亮相,被不少观展者誉为“镇馆之宝”。现场展出版本搭载16台计算柜、共计1024张昇腾卡,单柜以64卡为标准化起步配置,且64个超节点还可进一步互联,构建巨型算力集群。这一架构有效承载超长文本上下文,在AI对话和产业推理中,能够完整留存海量历史信息、精准捕捉细节逻辑,从而规避长对话中“记忆断层、信息丢失”的痛点。

超节点的价值,在于重构芯片协同逻辑,让不同芯片高效协同,专门解决超大模型与海量智能体并发计算的数据“堵塞”难题。

燧原科技创始人、董事长、CEO赵立东向记者描述了一套完整的人工智能算力五层体系:第一层是AI芯片,第二层是高密度服务器即超节点,第三层是网络层,第四层是分布式计算,第五层是AI大模型。五层环环相扣、高度适配,需要跨行业协作、系统化攻坚。

本届大会上,燧原科技联合中兴通讯发布“云燧ESL64-O超节点”,燧原科技创始人、总经理张亚林在“芯模协同”对话中指出,“芯模协同”是芯片和模型的“双向奔赴、双向成就”——模型依据芯片硬件特性调整结构,芯片针对模型架构优化加速,这种协同涵盖机柜、集群层面,是提升算力效能的关键。

公共云与全栈创新:Agent(智能体)时代的基础设施跃迁

超节点竞争并未停留于硬件参数。7月18日,阿里云正式发布灵骏真武M890超节点实例,首次通过公共云对外提供超节点形态AI算力服务。

阿里云弹性计算产品线负责人吴结生表示:“Agent(智能体)时代正在重新定义基础设施形态。当万亿参数MoE大模型需要更高效推理,当训练任务横跨成百上千张卡,‘单一领域优化’已无法满足需求。真正的答案,是把数据中心中芯片、服务器、网络、存储、基础设施软件凝聚成整体,提供一台能训练、能推理、开箱即用的‘AI超级计算机’。”

软件栈层面,平头哥在WAIC 2026上开源自研AI软件栈T-Head SAIL,覆盖OS层、SDK层与接口层完整链路,支持业务平滑顺畅迁移,主流模型即开即用。平头哥半导体副总裁高慧说:“开源AI软件栈只是开始,我们希望与全球开发者、科研机构及产业伙伴共同打磨工具链、丰富算子生态、优化性能体验。”目前,平头哥已推出真武系列AI芯片、磐脉系列智能网卡、镇岳系列存储主控芯片等数据中心核心芯片,实现算力、网力和存力的全栈自研。

算力到Token(词元):从规模扩张到智能密度竞争

算力的终极价值,正从“硬件规模”向“Token(词元)价值”跃迁。赵立东判断,Token(词元)正成为AI产业的价值载体与计价单位,“客户不再单纯为硬件成本付费,而是以Token(词元)生成效率与交付质量为核心评判标准。这要求我们从系统级、架构级层面优化算力综合成本,更好支撑Token经济发展。”

PPIO联合创始人兼CEO姚欣进一步提出Agent(智能体)时代核心公式,并发布全新Agentic Cloud定位及智能模型网关,打造面向Agent时代的“智能Token工厂”。截至2026年6月,PPIO日均Token调用量超1.2万亿,较2025年同期增长超8倍。

智能模型网关通过“混合模型”与“模型调度”两大核心功能,破解单模型“偏科”难题。

九章云极DataCanvas则在本届大会上展示了一套完整的“AI规模化生产体系”。九章云极提出,产业竞争正从“谁拥有更多卡”转向“谁让每张卡产生更大经济价值”。九章智算云3.0以智能队列调度、资源配额管理、开发工具套件三位一体构建算力治理闭环,让算力从“能买到”变为“用得好”。目前九章云极已覆盖十余个智算中心,并沿“一带一路”推进算力出海。

多元技术路线:重构算力效率天花板

在超节点竞赛中,不同技术路线正加速分化、协同并进。清微智能联合创始人、CTO欧阳鹏告诉记者:“如果只是跟随别人,别人的起点很可能就是你的天花板。特别是在工艺制程和供应链条件不同的情况下,做一模一样的东西,很难获得市场竞争力。”展台上,清微智能TX82芯片正式亮相——这是一颗基于可重构计算3.0的3D芯片,由一颗逻辑芯片与四颗存储芯片组成,欧阳鹏用了一个直观比喻:“3D芯片相当于把原来二维平面的连接变成三维连接,相当于从单车道变成四车道。”

曦望Sunrise董事长徐冰在“WAIC的清华朋友圈之夜”论坛上提出,推理基础设施是未来十年最大机遇。他指出,2026年是Token商业化元年,越来越多的Token由Agent消耗——“机器烧给机器”,需求由Agent数量、活跃时长、行动步骤、每步Token与验证重试倍数五个变量连乘决定,呈指数增长。徐冰用一个比方解释曦望押注大容量内存路线的逻辑:“在Agent系统里,内存不只是显卡的一个配置参数,它是数字员工的工位。工位越大,一台机器养得起的Agent越多,每个Agent记得住的事越久。”曦望第三代GPU采用大容量LPDDR内存,在长上下文、高并发等容量敏感负载中实现更低真实任务成本,为Agent规模化落地构建可负担的推理底座。

曦智科技则在本届WAIC上举办首个AI光算力产业论坛,提出“光³”概念——以光计算、光互连、光交换构建从芯片到系统的全栈光算力版图。公司展示了基于PACE 2打造的全球首款光电混合计算一体化“计算盒”——天枢·光立方,实现边缘场景即插即用,软件栈深度兼容主流AI框架。

从华为昇腾、燧原科技到阿里云、平头哥,从PPIO、九章云极到清微智能、曦望、曦智科技,一个清晰的信号已然释放:算力竞争已不再是一场单一芯片的“田径赛”,而是系统化、生态化、全栈化的“全能较量”。超节点,作为这场较量的核心载体,正在成为推动我国AI产业迈向全球前沿的新“大国重器”。在这场算力角逐中,国产力量正以集群创新之姿,为人工智能与实体经济深度融合筑牢算力底座,为全球AI治理贡献中国方案。