扫码体验VIP
网站公告:为了给家人们提供更好的用户体验和服务,股票复盘网V3.0正式上线,新版侧重股市情报和股票资讯,而旧版的复盘工具(连板梯队、热点解读、市场情绪、主线题材、复盘啦、龙虎榜、人气榜等功能)将全部移至VIP复盘网,VIP复盘网是目前市面上最专业的每日涨停复盘工具龙头复盘神器股票复盘工具复盘啦官网复盘盒子股票复盘软件复盘宝,持续上新功能,目前已经上新至V6.5.7版本,请家人们移步至VIP复盘网 / vip.fupanwang.com

扫码VIP小程序
返回 当前位置: 首页 热点财经 超节点:AI 宏观层的“韬定律”,超大参数模型的标配|国联民生计算机

股市情报:上述文章报告出品方/作者:民生证券,吕伟、胡又文等;仅供参考,投资者应独立决策并承担投资风险。

超节点:AI 宏观层的“韬定律”,超大参数模型的标配|国联民生计算机

时间:2026-07-25 23:38
上述文章报告出品方/作者:民生证券,吕伟、胡又文等;仅供参考,投资者应独立决策并承担投资风险。

1.1 超节点有望成为万亿参数大模型的重要算力底座


2026年5月,华为在IEEE ISCAS 2026上提出韬(τ)定律:当几何缩微逼近物理极限,半导体系统性能的提升路径从缩小晶体管转向压缩信号传播时延。这一逻辑可类比于超节点在AI算力层面的作用:大模型参数规模向万亿级别演进,算力瓶颈已不在单芯片,而在跨节点通信能力。超节点通过跨节点统一内存编址与硬件原生内存语义直访,将通信从软件路径转入硬件路径,使集群规模下算力利用率保持近线性扩展将大模型算力的扩展重心从单芯片性能转向系统级通信效率,成为万亿级别大模型规模化运行的关键架构方向。


超节点有望成为万亿参数大模型的核心算力底座传统"单芯片迭代 服务器横向堆叠"Scale-Out扩容路径已现双重瓶颈:一是先进制程演进边际收益递减,单芯片性能提升的成本持续抬升;二是分布式集群节点间地址空间独立,跨节点数据传输需经过多层软件协议栈处理,通信开销随并行规模扩大呈非线性增长,大量算力在数据等待中被闲置,Scaling Law延续在架构层面受到约束。通信时延是决定大规模并行效率的核心变量,超节点通过降低跨节点通信的软件开销,实现大规模并行下的近线性性能提升,成为下一代AI算力的核心底座。



超节点由多个物理计算节点通过专用高速协议连接,具备跨节点统一内存编址能力,逻辑上呈现"单台计算机"特征的紧耦合计算系统,核心是为大模型这类紧耦合并行负载提供垂直扩展的算力承载。与传统Scale-Out分布式集群相比,超节点从架构层面减小了跨节点通信的软件开销,提升了计算效率。


1.2 大模型全流程性能验证:万亿参数大模型的重要底座


大模型自回归推理存在Prefill(计算密集)与Decode(内存带宽密集)两种资源需求冲突的阶段,超节点可以成为实现P/D分离的重要支撑,因此有望成为下一代AI算力架构的核心形态。Decode阶段,决定性能的关键因素不再是GPU的峰值算力,而是其在单位时间内能够从显存中读取或写入数据的总量。这一性能直接影响着用户的另一个核心体验指标,即单Token生成延迟,它决定了后续文本生成的流畅度,进而P/D分离架构应运而生,新型的超节点服务器架构实现高效物理分离,凭借强大的内部互连网络,在内部进行P/D任务的划分。同时,在互联协议端,技术的进步可以更有效实现物理带宽能力的释放。以中国移动推动的OISA协议为例,新一代互连技术已经超越了单纯“数据管道”的角色,正在向系统管理中的主动参与者演进。



超节点已在大模型预训练、推理、后训练、多模态等流程中验证出架构价值。根据《超节点定义与实践白皮书》,预训练方面,万亿级参数模型的多卡并行部署带来海量集合通信开销,超节点通过NPU间大带宽低时延互联压缩通信开销,在DeepSeek V3训练中未掩盖通信比例降低80%,单NPU裸算力提升2倍条件下系统训练性能实现3倍以上提升。推理方面,万亿参数稀疏化模型需多机大专家并行,每Token推理面临高频跨节点小数据通信与长序列KV Cache缓存双重挑战,超节点通过NPU-to-NPU互联与全局资源池化,能够大幅提升计算效率。



后训练、多模态及Agentic AI场景进一步验证了超节点在大模型全生命周期中的架构延展性。后训练方面,强化学习需同时维护策略、价值、奖励及参考四个模型,参数与梯度同步通信量大,传统集群带宽瓶颈致训练效率下降40%~60%,超节点将模型传输时延从数十秒级降至毫秒级,70B模型RLHF训练中推理时延由数十秒降至秒级。多模态方面,T级参数模型的多任务负载对通信带宽与异构调度提出更高要求,超节点通过逻辑资源池化与内存语义小包超低时延通信提升分布式推理与3DGS重建效率。



1.3 超节点发展大势所趋,模算协同将是中国的伟大机遇


1.3.1 海外:英伟达NVL72代演进,全球超节点的代表性标杆之一


英伟达NVL72系列是全球超节点产品的标杆,从GB200到Vera Rubin,持续迭代并将超节点作为核心产品。



1.3.2 国内:重点厂商加速布局,关注模算协同机遇


浪潮信息元脑SD200超节点率先完成Kimi K2.6、DeepSeek V4、GLM 5.2、MiniMax M3等主流大模型的高性能优化,在Kimi K2.6万亿参数大模型上实现Token生成时间4.77ms,首Token延迟降低35%,为Agent场景应用的高效运行提供算力支撑。元脑SD200采用多主机低延迟内存语义通信架构,基于开放总线交换技术,在单机内实现64路本土GPU芯片统一寻址与高速互连,依托百纳秒级低延迟链路降低通信与显存访问开销



华为:国内超节点核心引领者,万卡级统一架构落地华为是国内超节点技术的核心引领者,已构建覆盖智算、通算、混合场景的完整超节点产品矩阵,通过自研全栈光互联技术突破万卡级统一架构瓶颈,是国内具备万卡级超节点落地能力的厂商。当前Atlas 900超节点已实现规模化部署,后续Atlas 950/960将沿规模扩张路径持续迭代,单超节点规模从384卡提升至1.5万卡级,算力实现百倍级跃升;同时华为将超节点技术延伸至通用计算领域,推出通用计算超节点TaiShan 950



中科曙光:无线缆架构创新,单机柜算力密度较高。中科曙光推出的超节点产品聚焦高密度Scale-Up纵向聚合,以无线缆正交架构为核心差异化,已形成X640与X40两大产品形态。


曙光X640:单机柜级640卡超节点千卡级计算单元。采用"一拖二"高密架构,实现单机柜640卡超高速总线互连,构建大规模、高带宽、低时延超节点通信域。双scaleX640超节点组成1,280卡计算单元,柜间通过高速网络互连。MoE大模型训练效率与高通量推理吞吐性能提升30%-40%。采用超高速正交架构,融合超高密度刀片、浸没相变液冷、高压直流供电等多技术创新,单机柜算力密度相比业界其他超节点最大提升20倍,PUE值低至1.04。基于AI计算开放架构设计,适配支持多品牌AI加速卡,兼容主流AI计算软件生态,适配优化400 主流大模型。


曙光X40:首个无线缆箱式超节点。面向万亿参数超大语言模型、多模态大模型的训练、微调、离线推理场景,解决传统多机8卡集群线缆繁杂、部署周期长、卡间通信瓶颈、运维故障率高的行业痛点。



1.4 投资建议


大模型参数规模向万亿级别演进,驱动AI算力需求持续快速增长,超节点正成为AI算力基础设施的核心演进方向。当前国内厂商在超节点领域已实现从整机柜级到万卡级统一架构的产品落地,国产算力产业链有望迎来重要发展机遇。建议重点关注:1)国产超节点龙头:浪潮信息中科曙光等;2)华为超节点产业链:软通动力神州数码中国长城慧博云通拓维信息等;3)国产AI芯片/CPU寒武纪海光信息中国长城云天励飞龙芯中科等。

2.行业新闻

腾讯混元整合成立基础模型部


腾讯宣布对混元大模型业务群进行重大组织架构调整,将混元多模态模型部门与大语言模型部门合并,成立“基础模型部”,统一由腾讯首席AI科学家姚顺雨管理。这是自2025年12月姚顺雨空降腾讯以来,混元体系进行的又一次深层次整合。腾讯方面表示,此次合并是为了进一步提升模型研发和协同效率,探索全模态模型的智能上限。


AMD发布新一代服务器处理器、MI400系列AI加速器等数据中心新品


超威半导体(AMD)发布了一系列面向数据中心的新产品,并表示这些产品的性能将超越竞争对手英伟达的同类产品,以期在快速增长的人工智能(AI)算力市场中进一步扩大份额。发布会上,AMD重点展示了新一代Helios服务器机架。这一设计将由服务器厂商自行制造并销售,最多可集成72颗MI400系列AI加速器。其中,MI455型号在内存带宽、推理速度和成本效率等方面,相较上一代产品均实现大幅提升。


OpenAI正式发布AI智能体运营平台Presence


OpenAI对外发布一款名为OpenAI Presence的新服务,旨在帮助企业更高效地部署和运行AI智能体。该平台能够将AI智能体与企业内部数据、管理制度、现有软件及业务流程进行深度链接,使AI更好地融入企业运营。该产品能够实现客户服务、销售等部分工作自动化,可处理账单问题、保险理赔支持、员工信息技术服务诉求等事务。Presence搭载多项功能,支持客户在特定业务场景下对智能体进行测试,并配备了模拟运行、安全护栏、人工复核以及AI自动化评估工具,用以校验智能体的输出结果。智能体在企业内部落地运行后,Presence可调用OpenAI Codex分析运行中暴露的短板,并提出优化建议。此外,Presence还内置了AI语音与对话技术,可协助企业客户更高程度地实现与现有及潜在客户的自动化互动。据OpenAI透露,公司自身已运用这款产品运营面向英语用户的AI电话客服通道。

3.公司新闻

浪潮信息关于公司2026年度第二期科技创新债券发行情况公告


2025年10月21日,公司发行中期票据的申请已经中国银行间市场交易商协会注册通过(中市协注[2025]MTN984 号),核定公司中期票据注册金额为100亿元,注册额度自通知书落款之日起2年内有效。在注册有效期内,公司可分期发行中期票据,发行完成后,通过中国银行间市场交易商协会认可的途径披露发行结果。近日,公司发行了2026年度第二期科技创新债券,本次发行规模为10亿元人民币。本次发行募集资金已于2026年7月24日全部到账。


海康威视2026年半年度报告


2026年上半年,公司实现营业总收入468.23亿元,比上年同期增长11.97%;实现归属于上市公司股东的净利润78.96亿元,比上年同期增长39.57%。公司始终坚持以技术创新驱动业务发展,保持高水平的研发投入,不断完善物联感知、人工智能和大数据三大核心技术体系。公司持续推进观澜大模型与软硬件产品深度融合,围绕安防业务和场景数字化业务不断丰富AI大模型产品体系,推动AI能力持续融入产品创新和场景应用,进一步提升产品智能化水平和场景应用价值。公司持续加强多维感知的核心技术能力建设,不断拓展智能物联技术应用边界,为产业数字化转型提供更加丰富的产品和解决方案。


卓易信息:关于以集中竞价交易方式回购股份的回购报告书


本次回购股份的资金总额不低于人民币2,000万元(含本数),不高于人民币4,000万元(含本数)。本次回购的价格不超过人民币186元/股(含本数),该价格不高于公司董事会审议通过本次回购股份方案前30个交易日公司股票交易均价的150%。在本次回购实施期间,具体由董事会授权公司管理层办理本次回购股份相关事宜,将综合二级市场股票交易价格、公司财务状况和经营状况等实施本次股份回购,最终以成交价格为准。

4.本周市场回顾

本周(07.20-07.24)沪深300指数上涨2.65%,中小板指数下跌0.56%,创业板指数上涨1.52%,计算机(中信)板块下跌0.19%。板块个股涨幅前五名分别为:锐捷网络证通电子中电鑫龙紫光股份港迪技术;跌幅前五名分别为:大恒科技*st航图、健麾信息格灵深瞳信息发展





5.风险提示

1)人工智能政策落地不及预期:如果在未来一段时间内,人工智能相关政策落地进度缓慢或存在变化,都有可能导致产业发展不及预期


2)行业竞争加剧:AI领域存在大量竞争者,未来为了在细分领域获取更大份额,可能存在市场、技术等方面竞争持续加剧的情况

股票复盘网
当前版本:V3.0