开云kaiyun超节点在国内越来越受到存眷-kai云体育app官方登录入口(中国)官方网站 IOS/安卓通用版/手机版
发布日期:2026-07-19 07:35    点击次数:172

刚罢了的2025全国东谈主工智能大会暨东谈主工智能大家经管高档别会议(WAIC)上开云kaiyun,华为展台展出一整面昇腾384超节点的“墙”。记者看到,不休有不雅众与之合影。

超节点(SuperPod)成为本届WAIC的热门。除了华为,WAIC期间,上海仪电还结合曦智科技、壁仞科技、中兴通讯发布国内首个光互连光交换GPU超节点光跃LightSphere X,新华三推出H3C UniPoD S80000超节点,超聚变也展出了超节点决策。业内东谈主士展望这波超节点热度会延续下去。

超节点是一种应付大算力集群芯片协同问题的决策。通过整划算力芯片资源,在一个超节点内构建低蔓延、高带宽的算力实体,让单个超节点尽可能地面开释算力,幸免芯片安稳,提高算力行使后果,撑捏千亿乃至万亿参数模子的磨真金不怕火和推理。

即等于在单颗算力芯片制程受限的情况下,超节点时间也能让集群性能络续莳植。壁仞科技OCS超节点名目关联负责东谈主董朝锋告诉记者,在国内,作念超节点也曾是个澄澈的趋势,跟着算力集群迈入“万卡协同”期间,探讨将来算力的构建范式演进相配蹙迫。

超节点为什么火了?

从千卡集群到万卡集群、十万卡集群,算力芯片集群越来越大,是因为大模子越来越大,参数目也曾迈向万亿。要若何作念好算力撑捏,业内不得不想考这个问题。

英伟达是较早布局超节点时间的代表厂商。英伟达GB300 NVLink72不错将72个GPU和36个CPU整合到单一平台。近期在布局超节点的国内厂商则包括AI芯片厂商和职业器厂商。

有芯片业内东谈主士向记者例如,一个万亿参数模子磨真金不怕火可能是这么的:简易估算需要1万张GPU,但为了具备容错才调,要有逾越1万张GPU。此外,要具备多个超节点,每个超节点内有几十张GPU,超节点里面也有冗余、容错才调,包括秒级容错和分钟级故障还原才调、调遣才调。调遣才调是指将万亿参数模子的磨真金不怕火差异到每个GPU上作念并行缱绻。

在这个万卡算力芯片集群中,超节点是一个很中枢的观点。董朝锋告诉记者,若是单机8卡不错跑一个70亿参数的模子,当模子参数达到千亿、万亿,就需要更多GPU职业器。但是,传统AI职业器的scale out(横向拓展)互连由于线性度关连会导致算力性能的亏蚀。在莫得超节点的情况下,机柜之间由于线性度的影响会有算力性能亏蚀,导致“1+1”无法等于“2”。但若是有超节点,则能保证单个节点内的性能最优。

有从业者告诉记者,若是莫得超节点,一个机箱单机8卡,只可作念到每2卡之间的带宽、通讯蔓延一致。董朝锋告诉记者,超节点有两条门道,一是scale out横向拓展,二是scale up纵向拓展。纵向拓展即在一个节点内尽可能多地加多GPU,例如一个千卡集群中,每64卡是一个超节点,在这个超节点中,不错作念到卡间、机间的通讯带宽、通讯基本一致。

超节点时间中,光互连是主流地方之一,属于光通讯鸿沟。光互连有全光交换、全光互连、光互连电交换门道。业内东谈主士告诉记者,与光互连电交换比较,光互连光交换不错依托于光芯片,将电交换才召回荡成光交换才调,光的切换是纳秒级,因此不错天表示换拓扑且带宽较高。光通讯可保证集群与集群之间高带宽、低蔓延。

这次上海仪电结合曦智科技、壁仞科技、中兴通讯发布的超节点决策就给与差异式光互连光交换时间,该决策使用曦智科技的光互连光交换芯片和壁仞科技的GPU液冷模组,搭载中兴通讯的AI职业器。新华三推出的超节点居品则基于以太公约和PCIe公约,可适用多种算力芯片,适用万亿级参数大模子磨真金不怕火和推理。此外,WAIC上展出的华为昇腾384超节点可通过总线时间杀青384个NPU(神经汇集处理器)之间的大带宽低时延互连。

超节点在国内越来越受到存眷,其背后,是因为超节点时间成为莳植芯片制程以外,另一条能提高芯片集群性能的旅途。跟着摩尔定律濒临“失灵”风险,鼓励芯片制程演进的难度增大,莳植单颗芯片的缱绻性能濒临挑战,业界需要寻找新的智商来络续莳植算力。

董朝锋告诉记者,在芯片莳植制程以外,超节点时间是能让集群性能莳植的智商之一。短期内,国产AI芯片在制程工艺上与全国顶尖水平存在客不雅差距,国内厂商不错通过超节点决策部署更大规模的芯片集群来弥补单点性能的不及,以量补质,也能通过超节点时间让集群性能络续莳植。其中光芯片也不错不依赖于高制程。

有业内东谈主士告诉记者,英伟达的互连决策相对闭塞,自有GPU、配套软硬件,国内一些厂商则在作念怒放生态。相较英伟达全套自研的门道,国内还莫得访佛英伟达这么成系统的时间体系。近期国内好多厂商包括职业器厂商皆在实践超节点,各家门道各不十足一样,还需要时期来解释时间优劣。总体而言,国内光通讯时间在大家比较率先,与国际先进水平比较莫得澄澈代差。

应付商场竞争

本年国产芯片在AI职业器中的占比已在莳植。TrendForce集邦计议数据暴露,旧年国内AI职业器芯片中,外购部分(包括英伟达、AMD)所占商场份额为63%。该机构最新展望,外购部分本年的占比将降至49%。

即便如斯,国际芯片厂商仍疼爱中国商场。英伟达CEO黄仁勋在本月早些时候暗示,英伟达将推露面向中国商场的全新GPU。

除了通过互连时间优化莳植芯片集群的后果,国内芯片厂商在芯片想象、商场战略上也在寻找智商,应付商场竞争。

墨芯东谈主工智能这次在WAIC上展出了S40等缱绻卡。该公司关联负责东谈主告诉记者,与英伟达的竞争弗成只在居品质能高下功夫,还不错遴选间接竞争的战略。英伟达的GPU是通用型GPU,可用于磨真金不怕火和推理,不会针对一些垂直行业绝顶作出更动,但国产芯片不错有一些更动。该公司的居品针对推理作念了优化,鸠合面向AI推理场景,例如旯旮缱绻一体机,在特定场景下不错有更快缱绻速率和更低功耗。

上述公司关联负责东谈主告诉记者,好多芯片厂商主要面向稠密缱绻需求,该公司则给与软硬件结合的战略,在软件算法上给与寥落缱绻时间。与稠密缱绻的卡不同,面向寥落缱绻的卡对制程的条目不高,不错给与12nm制程。当今公司的居品比较适用于特定场景的小模子运算,后续将推出的新址品则界说为广义寥落的居品,适用于大模子缱绻。

其他一些国产芯片厂商也解除了与国际AI芯片巨头的平直竞争。

云天励飞相同遴选了AI推理场景。该公司在WAIC期间通知将全面聚焦AI芯片,将来将重心围绕旯旮缱绻、云霄大模子推理和具身智能鸿沟布局。云天励飞董事长兼CEO陈宁暗示,云侧推理更多计议多用户并行情况下的芯片硬件采购本钱、集群电费等运营本钱,旯旮缱绻则对芯片硬件采购本钱更敏锐,且更看护芯片与场景结合时的灵验算力。他判断,以AI大模子和千般AI算法、推理芯片为中枢的AI时间,将在将来五年从头界说东谈主类悉数的电子居品。

后摩智能近日则推出新一代芯片,面向端边场景。该公司新一代端边大模子AI芯片后摩漫界M50在INT8精度下的算力为160TOPS,在bFP16精度下的算力为100TFLOPS。当今该公司的芯单方面向平板、PC等消耗终局,以及智能语音会议系统、运营商旯旮缱绻场景。该公司还给与存算一体时间,处理传统芯片数据传输慢、功耗较高的问题。

后摩智能首创东谈主、CEO吴强暗示,定位端边大模子缱绻,一定进度上解除了和巨头竞争高壁垒居品和已固化的商场,此外,还不错推崇存算一体时间的上风,在新兴的AI PC、智能语音拓荒、具身智能等新兴赛谈找到位置。

举报 第一财经告白趋附,请点击这里此骨子为第一财经原创,著述权归第一财经悉数。未经第一财经籍面授权,不得以任何格式加以使用,包括转载、摘编、复制或设立镜像。第一财经保留讲究侵权者法律包袱的职权。如需取得授权请筹谋第一财经版权部:banquan@yicai.com 文章作家

郑栩彤

关联阅读 6亿+3亿+1亿!上海“东谈主工智能12条”给这些群体发礼包

披发6亿元算力券,披发3亿元模子券,披发1亿元语料券。

124 07-28 18:45 国内首个光互连光交换GPU超节点发布

国内首个光互连光交换GPU超节点发布

58 07-28 16:21 AI进化速递丨王兴兴:AI大模子写代码见效力已相配高

①《大家东谈主工智能转换指数诠释2025》发布;②我国大模子数目居大家首位;③AI投资定约认真成立,聚焦AI鸿沟投资。

54 07-27 21:32 AI进化速递 丨国产具身大模子初次取得汽车制造全场景考证

①国产具身大模子初次取得汽车制造全场景考证;②2025大家东谈主工智能时间大会在杭举办;③广西在AI时间研发与应用鸿沟获蹙迫毁坏。

101 06-08 20:28 长三角先进制造业集群定约本日揭牌成立开云kaiyun

长三角先进制造业集群定约本日揭牌成立

30 06-07 11:03 一财最热 点击关闭