1.本周观点
1.1 国产大模型:从架构与系统层面对国产算力进行适配优化
架构层面,大模型推理中注意力计算是显存消耗与带宽压力的最大来源。在此背景下,稀疏注意力与低激活参数成为国产大模型优化的主要方向之一。观察部分头部模型厂的新一代架构,可以看到高度趋同的解法——用稀疏/线性注意力压缩注意力计算,同时大幅压低激活参数量:
智谱GLM-5.3-Flash总参数量320B(与GLM-4.5的355B基本相当),激活参数量由32B压缩至18B、层数由92层减至45层,采用线性注意力与稀疏注意力混合架构,稀疏注意力引入IndexPool索引器;DeepSeek-V4在token维度压缩上下文,结合DSA稀疏注意力,1M上下文成为全系服务标配。稀疏/线性注意力将注意力计算的显存与带宽需求大幅压缩,缓解显存消耗与带宽压力。

系统层面,智谱GLM-5.3-Flash公开服务全部由国产算力支撑,验证国产芯片的可行性边界。GLM-5.3-Flash公开服务在试用期间全部由国产算力支撑,依托国产芯片集群与自研高带宽互联网络,首次在大规模流量场景下承担前沿模型推理。最终效果是端到端服务性能较同一硬件基线提升3倍,硬件效率与单token成本达到与主流英伟达GPU相当的水平。另一个值得注意的细节:全部构建与优化工作由GLM-5.3驱动的infra agent协助完成(算子开发、瓶颈诊断、部署栈改进),模型能力开始反哺算力优化效率本身。商业化方面,GLM-5.3-Flash已全球开源,接入ZCode等编码平台,纳入GLM Coding Plan(每天限量发放10,000张体验卡)并开放API。

1.2 国产算力:适配沿多条路线快速成熟,头部公司业绩高增验证行业高景气
芯片自建软件栈:以龙头为例,积极适配国产生态。2026年8月26日,寒武纪在GLM-5.3-Flash发布当天完成适配。寒武纪Neuware软件栈原生支持PyTorch、vLLM等主流AI框架,MLA、MHC、MoE、MTP等适配基础设施开箱即用,并利用Triton的社区兼容性快速完成算子开发。

针对模型线性注意力与稀疏注意力混合架构,寒武纪对IndexPool索引器完成Token粒度到Pool粒度的地址换算、在Decode阶段对全历史Gather分块控制峰值;线性注意力以循环状态替代传统KV Cache,寒武纪在Decode路径采用批量张量化、Prefill路径采用递推结构分块并行,并自研MLU Triton内核完成核心计算,线性注意力性能获得量级提升。
向商业化进发,海光信息加速国产生态布局。海光信息在2026数博会首发“Agent to Token开放计算架构”:依托CPU与DCU双芯协同与开放互连,贯通Agent任务执行与词元生产的完整计算周期。CPU承担任务编排、实时决策及通用计算,DCU专注AI计算与词元生产加速。该架构在算力、互连、安全、软件栈四个维度开放对接,支持异构算力灵活组合、多协议互连协同、全链路安全防护及全栈软件适配。生态方面,以海光为核心的光合组织已汇聚六千余家生态伙伴,覆盖数据处理、算力供给、模型运行与智能应用全链条,为词元经济规模化落地提供体系化支撑。
开源跨芯片公共底座:FlagOS已形成“核心库—插件—领域项目—工具与服务”多层开源组件体系。国产芯片种类较多,过去每款模型需在每款芯片上重复适配。FlagOS 是一个完全开源的异构 AI 芯片系统软件栈,允许 AI 模型一次开发即可无缝移植到广泛的 AI 硬件平台,实现最小化的适配成本。1)核心库是底座:FlagGems通用算子库及多个细分算子库提供计算支撑,FlagTree统一编译器让同一套算子代码运行在多家国产芯片上,FlagScale覆盖模型训练到部署全流程,FlagCX解决跨芯片通信。2)插件层负责“连接”:把vLLM、SGLang等主流推理框架,以及Megatron-LM等训练、强化学习框架接入FlagOS,兼顾推理与训练全流程。3)领域项目向具身智能和量子模拟延伸。4)工具与服务层面,KernelGen可用自然语言自动生成算子,FlagOS Skills兼容Claude Code等主流Agent,FlagRelease自动完成模型跨芯片迁移与发布,FlagPerf负责硬件性能评测,FlagCICD打通跨芯片持续集成。

模型厂商垂直整合:智谱收购中科加禾,进一步加强国产大模型与国产算力的适配优化能力。智谱收购AI异构算力软件公司中科加禾。中科加禾技术源头为中科院计算所编译实验室,对上为AI模型提供统一标准接口,对下适配华为昇腾、寒武纪、海光等主流国产芯片,产品包括SigInfer推理引擎、SigFT微调引擎与SigTrans算子生成工具。中科加禾依托编译技术打造通用化、低成本、高性能的基础软件工具链,为用户提供AI应用跨多种CPU、GPU、NPU执行的统一软件平台。


2026年上半年,国产算力芯片龙头寒武纪、海光信息均实现收入与利润的高速增长,反映出人工智能算力需求持续高景气下国产芯片的放量趋势。寒武纪实现营业收入59.96亿元,同比增长108.13%;归母净利润23.11亿元,同比增长122.61%;扣非归母净利润21.66亿元,同比增长137.30%,扣非利润增速快于收入增速,规模效应与经营杠杆持续显现。海光信息同期实现营业收入90.99亿元,同比增长66.52%;归母净利润17.98亿元,同比增长49.69%;扣非归母净利润16.31亿元,同比增长49.67%。

AI 服务器龙头浪潮信息上半年业绩大幅改善,2026Q2迎来重要拐点。公司发布 2026 年半年度报告,上半年实现归母净利润29.52亿元,同比增长269.59%;扣非归母净利润24.19亿元,同比增长260.08%。
通过梳理国产AI芯片、服务器等环节的领军企业,可以发现国产算力目前景气度正处于持续快速提升阶段,主要公司业绩均呈现大幅增长态势。


1.3 投资建议
算力网建设在"十五五"万亿级别直接投资的政策驱动下进入加速落地期,叠加国产算力公司业绩高增与大厂资本开支持续加码,国产算力景气度有望延续。同时,发展自主大模型与自主算力的紧迫性与战略意义持续凸显,国模加国芯的模算协同、全国产大模型迎来重大战略机遇。建议关注:1)国产大模型:智谱、MiniMax等;2)国产算力:寒武纪、海光信息、云天励飞等。3)超节点及算力网等算力服务提供商:浪潮信息、软通动力、紫光股份、中国长城、联想集团、神州数码、思特奇等。4)算力租赁方向的宏景科技、集智股份(ARM Token工厂)、协创数据、利通电子、行云科技、智微智能、阿里巴巴、优刻得、金山云等标的。
2.行业新闻
智谱发布并开源GLM-5.3-Flash
智谱正式发布并开源GLM-5.3-Flash,为GLM-5系列首个原生多模态模型,总参数320B、激活参数18B。官方称其综合能力超过GLM-5.2,在AA综合智能指数中获57分,与Claude Opus 4.8持平;模型采用稀疏注意力与线性注意力混合架构,支持视觉编码及办公、金融、法律等专业任务,并已在国产芯片集群上实现大规模推理服务。定价为GLM-5.3的1/10,限时折扣为1/20。
腾讯混元正式发布新一代大语言模型Hy4 preview
Hy4 preview最核心的技术突破,是在自身研发的全链路过程中发挥了积极价值,首次参与训练方法、数据策略、评估体系和底层算子的自动优化。具体表现为,模型提出方案、运行实验并根据结果继续迭代,实验产生的代码、日志和反馈进入下一轮探索,形成初步的递归自我改进闭环。与此同时,Hy4 preview通过自主分析推理系统瓶颈,围绕算子融合、通信优化等方向开展多轮优化,端到端吞吐相较基线提升31.8%。
亚马逊将加购200万块英伟达GPU
英伟达第二财季财报的发布同时,亚马逊与英伟达宣布扩大合作伙伴关系,以应对AI基础设施日益增长的需求。两家公司计划于2027年至2028年间,在亚马逊云科技(AWS)全球基础设施中额外部署200万块英伟达GPU。
阿里巴巴宣布800亿港元港股配售
3.公司新闻
浪潮信息:2026年上半年实现营业收入843.79亿元,同比增长5.22%;归母净利润29.52亿元,同比增长269.59%。公司已推出兆瓦级两相液冷AI整机柜方案,单芯片散热能力突破3000W,单位面积散热达每平方厘米250W以上,前瞻适配未来GW级AI数据中心建设需求;元脑智算算力仓则通过算力、液冷及基础设施一体化设计,在京津冀、西南、西北等地区持续落地。
中国长城:公司2026年上半年实现营业收入79.58亿元,同比增长25.00%;归属于上市公司股东的净利润3.12亿元,同比增长125.71%。公司计划不派发现金红利,不送红股,不以公积金转增股本。公司扣除非经常性损益后的净利润为-3.16亿元,上年同期为-4.27亿元,亏损有所收窄。
中科曙光:8月28日数博会上,中科曙光正式发布了新一代词元加速方案:ParaCache。据介绍,ParaCache通过长时间保存和复用已有计算结果,减少推理过程中的重复计算,使同一套算力资源能够服务更多业务请求。该方案已在曙光8000推理应用场景完成验证,并兼容主流推理生态,有助于企业优化单位词元成本和大模型部署效率。
卓易信息:2026年上半年营业收入1.78亿元,同比增长2.00%;归属于上市公司股东的净利润1.06亿元,同比增长291.66%,2025年同期为2712.55万元;归属于上市公司股东的扣除非经常性损益的净利润4730.32万元,同比增长126.12%。
4.本周市场回顾
本周(8.24-8.28)沪深300指数下跌0.21%,中小板指数上涨0.15%,创业板指数下跌3.42%,计算机(中信)板块上涨1.11%。板块个股涨幅前五名分别为:楚天龙、中安科、汇金股份、鼎捷数智、兆日科技;跌幅前五名分别为:ST佳缘、魅视科技、和达科技、格灵深瞳、达梦数据。




5.风险提示
1)人工智能政策不及预期:如果在未来一段时间内,人工智能相关政策落地进度缓慢或存在变化,都有可能导致产业发展不及预期。
2)行业竞争加剧:AI领域存在大量竞争者,未来为了在细分领域获取更大份额,可能存在市场、技术等方面竞争持续加剧的情况。


VIP复盘网