扫码体验VIP
网站公告:为了给家人们提供更好的用户体验和服务,股票复盘网V3.0正式上线,新版侧重股市情报和股票资讯,而旧版的复盘工具(连板梯队、热点解读、市场情绪、主线题材、复盘啦、龙虎榜、人气榜等功能)将全部移至VIP复盘网,VIP复盘网是目前市面上最专业的每日涨停复盘工具龙头复盘神器股票复盘工具复盘啦官网复盘盒子股票复盘软件复盘宝,持续上新功能,目前已经上新至V6.5.7版本,请家人们移步至VIP复盘网 / vip.fupanwang.com

扫码VIP小程序
返回 当前位置: 首页 热点财经 【国联民生计算机】GLM5.3-Flash全面激活国产算力

股市情报:上述文章报告出品方/作者:民生证券,吕伟、胡又文等;仅供参考,投资者应独立决策并承担投资风险。

【国联民生计算机】GLM5.3-Flash全面激活国产算力

时间:2026-08-30 10:50
上述文章报告出品方/作者:民生证券,吕伟、胡又文等;仅供参考,投资者应独立决策并承担投资风险。

1.本周观点

1.1 国产大模型:架构与系统层面对国产算力进行适配优化


架构层面,大模型推理中注意力计算是显存消耗与带宽压力的最大来源。在此背景下,稀疏注意力与低激活参数成为国产大模型优化的主要方向之一观察部分头部模型厂的新一代架构,可以看到高度趋同的解法——用稀疏/线性注意力压缩注意力计算,同时大幅压低激活参数量:


智谱GLM-5.3-Flash总参数量320B(与GLM-4.5的355B基本相当),激活参数量由32B压缩至18B、层数由92层减至45层,采用线性注意力与稀疏注意力混合架构,稀疏注意力引入IndexPool索引器;DeepSeek-V4在token维度压缩上下文,结合DSA稀疏注意力,1M上下文成为全系服务标配。稀疏/线性注意力将注意力计算的显存与带宽需求大幅压缩,缓解显存消耗与带宽压力。



系统层面,智谱GLM-5.3-Flash公开服务全部由国产算力支撑,验证国产芯片的可行性边界。GLM-5.3-Flash公开服务在试用期间全部由国产算力支撑依托国产芯片集群与自研高带宽互联网络,首次在大规模流量场景下承担前沿模型推理。最终效果是端到端服务性能较同一硬件基线提升3倍,硬件效率与单token成本达到与主流英伟达GPU相当的水平。另一个值得注意的细节:全部构建与优化工作由GLM-5.3驱动的infra agent协助完成(算子开发、瓶颈诊断、部署栈改进),模型能力开始反哺算力优化效率本身。商业化方面,GLM-5.3-Flash已全球开源,接入ZCode等编码平台,纳入GLM Coding Plan(每天限量发放10,000张体验卡)并开放API



1.2 国产算力:适配沿多条路线快速成熟,头部公司业绩高增验证行业高景气


芯片自建软件栈:以龙头为例,积极适配国产生态。2026826日,寒武纪GLM-5.3-Flash发布当天完成适配。寒武纪Neuware软件栈原生支持PyTorchvLLM等主流AI框架,MLAMHCMoEMTP等适配基础设施开箱即用,并利用Triton的社区兼容性快速完成算子开发。



针对模型线性注意力与稀疏注意力混合架构,寒武纪IndexPool索引器完成Token粒度到Pool粒度的地址换算、在Decode阶段对全历史Gather分块控制峰值;线性注意力以循环状态替代传统KV Cache,寒武纪在Decode路径采用批量张量化、Prefill路径采用递推结构分块并行,并自研MLU Triton内核完成核心计算,线性注意力性能获得量级提升。


向商业化进发,海光信息加速国产生态布局。海光信息2026数博会首发Agent to Token开放计算架构:依托CPU与DCU双芯协同与开放互连,贯通Agent任务执行与词元生产的完整计算周期CPU承担任务编排、实时决策及通用计算,DCU专注AI计算与词元生产加速。该架构在算力、互连、安全、软件栈四个维度开放对接,支持异构算力灵活组合、多协议互连协同、全链路安全防护及全栈软件适配。生态方面,以海光为核心的光合组织已汇聚六千余家生态伙伴,覆盖数据处理、算力供给、模型运行与智能应用全链条,为词元经济规模化落地提供体系化支撑。


开源跨芯片公共底座:FlagOS已形成核心库插件领域项目工具与服务多层开源组件体系国产芯片种类较多,过去每款模型需在每款芯片上重复适配。FlagOS 是一个完全开源的异构 AI 芯片系统软件栈,允许 AI 模型一次开发即可无缝移植到广泛的 AI 硬件平台,实现最小化的适配成本。1)核心库是底座:FlagGems通用算子库及多个细分算子库提供计算支撑,FlagTree统一编译器让同一套算子代码运行在多家国产芯片上,FlagScale覆盖模型训练到部署全流程,FlagCX解决跨芯片通信。2)插件层负责连接:把vLLM、SGLang等主流推理框架,以及Megatron-LM等训练、强化学习框架接入FlagOS,兼顾推理与训练全流程。3)领域项目向具身智能和量子模拟延伸。4)工具与服务层面,KernelGen可用自然语言自动生成算子,FlagOS Skills兼容Claude Code等主流Agent,FlagRelease自动完成模型跨芯片迁移与发布,FlagPerf负责硬件性能评测,FlagCICD打通跨芯片持续集成。



模型厂商垂直整合:智谱收购中科加禾,进一步加强国产大模型与国产算力的适配优化能力。智谱收购AI异构算力软件公司中科加禾。中科加禾技术源头为中科院计算所编译实验室,对上为AI模型提供统一标准接口,对下适配华为昇腾、寒武纪、海光等主流国产芯片,产品包括SigInfer推理引擎、SigFT微调引擎与SigTrans算子生成工具。中科加禾依托编译技术打造通用化、低成本、高性能的基础软件工具链,为用户提供AI应用跨多种CPU、GPU、NPU执行的统一软件平台。




2026年上半年,国产算力芯片龙头寒武纪海光信息均实现收入与利润的高速增长,反映出人工智能算力需求持续高景气下国产芯片的放量趋势。寒武纪实现营业收入59.96亿元,同比增长108.13%;归母净利润23.11亿元,同比增长122.61%;扣非归母净利润21.66亿元,同比增长137.30%,扣非利润增速快于收入增速,规模效应与经营杠杆持续显现。海光信息同期实现营业收入90.99亿元,同比增长66.52%;归母净利润17.98亿元,同比增长49.69%;扣非归母净利润16.31亿元,同比增长49.67%



AI 服务器龙头浪潮信息上半年业绩大幅改善,2026Q2迎来重要拐点公司发布 2026 年半年度报告,上半年实现归母净利润29.52亿元,同比增长269.59%;扣非归母净利润24.19亿元,同比增长260.08%。


通过梳理国产AI芯片、服务器等环节的领军企业,可以发现国产算力目前景气度正处于持续快速提升阶段,主要公司业绩均呈现大幅增长态势。

 


国内头部互联网厂商持续加大AI基础设施投入,资本开支同比大幅增长,为上游算力硬件需求提供坚实支撑。腾讯2026年上半年资本开支达847.20亿元,同比增长82%,其中二季度单季资本开支527.84亿元,主要投向数据中心、服务器等AI基础设施。阿里巴巴2027财年第一季度资本开支达676.78亿元,同比增长75%,主要用于AI算力采购、CPU算力扩容及芯片组件投入。两家大厂单季资本开支均处历史高位,反映出云厂商及互联网巨头在AI算力扩容上的持续加码,算力硬件需求高景气度有望延续。



1.3 投资建议


算力网建设在"十五五"万亿级别直接投资的政策驱动下进入加速落地期,叠加国产算力公司业绩高增与大厂资本开支持续加码,国产算力景气度有望延续。同时,发展自主大模型与自主算力的紧迫性与战略意义持续凸显,国模加国芯的模算协同、全国产大模型迎来重大战略机遇建议关注:1)国产大模型:智谱、MiniMax等;2)国产算力:寒武纪海光信息云天励飞等。3超节点及算力网等算力服务提供商:浪潮信息软通动力紫光股份中国长城、联想集团、神州数码思特奇4)算力租赁方向的宏景科技集智股份ARM Token工厂)、协创数据利通电子行云科技智微智能、阿里巴巴、优刻得、金山云等标的。

2.行业新闻

智谱发布并开源GLM-5.3-Flash


智谱正式发布并开源GLM-5.3-Flash,为GLM-5系列首个原生多模态模型,总参数320B、激活参数18B。官方称其综合能力超过GLM-5.2,在AA综合智能指数中获57分,与Claude Opus 4.8持平;模型采用稀疏注意力与线性注意力混合架构,支持视觉编码及办公、金融、法律等专业任务,并已在国产芯片集群上实现大规模推理服务。定价为GLM-5.3的1/10,限时折扣为1/20。


腾讯混元正式发布新一代大语言模型Hy4 preview


Hy4 preview最核心的技术突破,是在自身研发的全链路过程中发挥了积极价值,首次参与训练方法、数据策略、评估体系和底层算子的自动优化。具体表现为,模型提出方案、运行实验并根据结果继续迭代,实验产生的代码、日志和反馈进入下一轮探索,形成初步的递归自我改进闭环。与此同时,Hy4 preview通过自主分析推理系统瓶颈,围绕算子融合、通信优化等方向开展多轮优化,端到端吞吐相较基线提升31.8%。


亚马逊将加购200万块英伟达GPU


英伟达第二财季财报的发布同时,亚马逊与英伟达宣布扩大合作伙伴关系,以应对AI基础设施日益增长的需求。两家公司计划于2027年至2028年间,在亚马逊云科技(AWS)全球基础设施中额外部署200万块英伟达GPU。


阿里巴巴宣布800亿港元港股配售


823日,阿里巴巴宣布启动2019年上市以来的首次新股配售,募资总额高达800亿港元。阿里巴巴此次计划向美国境外非美国人士发行新股,所得款项净额将100%用于投资全栈人工智能能力与基础设施建设。

3.公司新闻

浪潮信息2026年上半年实现营业收入843.79亿元,同比增长5.22%;归母净利润29.52亿元,同比增长269.59%。公司已推出兆瓦级两相液冷AI整机柜方案,单芯片散热能力突破3000W,单位面积散热达每平方厘米250W以上,前瞻适配未来GW级AI数据中心建设需求;元脑智算算力仓则通过算力、液冷及基础设施一体化设计,在京津冀、西南、西北等地区持续落地。


中国长城公司2026年上半年实现营业收入79.58亿元,同比增长25.00%;归属于上市公司股东的净利润3.12亿元,同比增长125.71%。公司计划不派发现金红利,不送红股,不以公积金转增股本。公司扣除非经常性损益后的净利润为-3.16亿元,上年同期为-4.27亿元,亏损有所收窄。


中科曙光8月28日数博会上,中科曙光正式发布了新一代词元加速方案:ParaCache。据介绍,ParaCache通过长时间保存和复用已有计算结果,减少推理过程中的重复计算,使同一套算力资源能够服务更多业务请求。该方案已在曙光8000推理应用场景完成验证,并兼容主流推理生态,有助于企业优化单位词元成本和大模型部署效率。


卓易信息2026年上半年营业收入1.78亿元,同比增长2.00%;归属于上市公司股东的净利润1.06亿元,同比增长291.66%,2025年同期为2712.55万元;归属于上市公司股东的扣除非经常性损益的净利润4730.32万元,同比增长126.12%。


同花顺浙江核新同花顺网络信息股份有限公司(以下简称公司)于2026515日发布《关于董事、持股5%以上股东减持股份预披露的公告》(公告编号:2026-018)。持有本公司股份26,185,715股(占本公司总股本3.48%)的董事王进先生,持有本公司股份37,253,583股(占本公司总股本4.95%)的董事于浩淼先生,持有本公司股份66,492,621股(占本公司总股本8.83%)的股东杭州凯士顺科技有限公司(以下简称凯士顺),拟于202668-202697日,以集中竞价交易方式或大宗交易方式合计减持股份不超过4,065,000股(占公司总股本的0.54%)。近日,公司收到董事王进先生、于浩淼先生及股东凯士顺分别出具的《关于浙江核新同花顺网络信息股份有限公司股份减持计划实施完成的通知函》,本次减持计划已实施完成

4.本周市场回顾

本周(8.24-8.28)沪深300指数下跌0.21%,中小板指数上涨0.15%,创业板指数下跌3.42%,计算机(中信)板块上涨1.11%。板块个股涨幅前五名分别为:楚天龙中安科汇金股份鼎捷数智兆日科技;跌幅前五名分别为:ST佳缘魅视科技和达科技格灵深瞳达梦数据





5.风险提示

1)人工智能政策不及预期:如果在未来一段时间内,人工智能相关政策落地进度缓慢或存在变化,都有可能导致产业发展不及预期


2)行业竞争加剧:AI领域存在大量竞争者,未来为了在细分领域获取更大份额,可能存在市场、技术等方面竞争持续加剧的情况

股票复盘网
当前版本:V3.0