英伟达迎来最大挑战?算力寡头自研芯片跑赢 GB300
时间:2026-08-27 06:55
上述文章报告出品方/作者:电子发烧友网;仅供参考,投资者应独立决策并承担投资风险。
电子发烧友网报道如果说过去两年,全球 AI 产业的叙事主线是 “所有公司都在疯狂抢购英伟达 GPU”,那么到 2028 年,这条主线或将迎来一个值得警惕的终局:全球大部分可用 AI 算力,将集中掌握在 OpenAI 和 Anthropic 两家企业手中。SemiAnalysis 创始人 Dylan Patel 判断,到 2028 年,Anthropic 与 OpenAI 将掌控全球大部分可用 AI 算力。按照今年新增 30 吉瓦、明年 50 吉瓦、后年 70 吉瓦的算力增量测算,2027 年底两家企业将占据新增算力的半壁江山;加之新一代芯片每瓦性能达到前代的 3‑5 倍,这半数新增算力所能输出的实际算力产出,将大幅超越全部存量算力。与此同时,OpenAI 代号为 “Jalapeno” 的自研芯片,正对英伟达的行业霸主地位发起正面冲击。而这场技术较量的走向,或将决定上述算力集中格局的最终形态。要预判 2028 年的行业格局,需要先读懂 SemiAnalysis 创始人 Dylan Patel 提出的算力增长模型。从电力消耗维度统计,全球 AI 算力正高速扩张:今年、明年和后年的增量预计为 30 吉瓦、50 吉瓦和 70 吉瓦。截至 2027 年底,OpenAI 和 Anthropic 两家,将占据半数以上的新增算力。更关键的是芯片代际差带来的乘数效应。Dylan Patel 指出,新一代 AI 芯片每瓦性能为前代的 3‑5 倍。假设截至 2024 年底已部署的存量算力能效系数为 1.0;2027 年底全部新增 70 吉瓦算力之中,OpenAI、Anthropic 占有 35 吉瓦,且这部分算力将搭载最新一代芯片,能效系数可达 3‑5。按此测算,全球约 100 吉瓦存量算力等效产出约为 100;两家企业所持 35 吉瓦新增算力,等效产出可达 105‑175。也就是说,OpenAI 与 Anthropic 手握的这 50% 新增算力,在 Token 生成、模型训练吞吐量等实际产出层面会被成倍放大。当这批具备 3‑5 倍能效优势的算力落地投产,它所输出的实际能力,将远超同期全部存量算力之和。算力向头部集中并非偶然现象。大模型训练算力需求呈指数级攀升,但电力供给、土地资源、冷却基础设施、芯片产能的扩张速度难以匹配算力增长。资源的稀缺性,天然向能够预付大额定金、签署长期电力协议、自建数据中心的头部企业倾斜。Anthropic 深度绑定亚马逊云科技、OpenAI 联合微软并对接多家能源供应商,正是这一产业逻辑的现实体现。Jalapeno:OpenAI 的 “芯片独立宣言”
如果电力与数据中心构筑起算力垄断的硬件底座,自研芯片就是放大算力优势的技术加速器。OpenAI 芯片业务负责人 Richard Ho 在采访中披露关键信息:自研 AI 处理器 Jalapeno,在对标英伟达当前旗舰产品 GB300 的对比测试中,两项核心指标实现领先。第一是单位功耗 AI 处理能力,即能效比(performance per watt)。在数据中心场景下,电力已经成为 AI 训练与推理阶段最主要运营成本。能效优势直接转化为 TCO 总拥有成本优势。当算力规模达到数十吉瓦级别,即便仅实现 10% 的能效提升,每年也可节省数亿美元成本。第二是推理响应速度。面向 C 端、B 端的 AI 服务中,推理延迟直接决定用户体验。Jalapeno 在响应速度上的优势,代表 OpenAI 既可以同等硬件成本下提供更低延迟服务,也可以在相同延迟约束下部署复杂度更高的模型。值得关注的是测试选用的模型组合。OpenAI 并未局限于自家模型开展内部自测,测试集涵盖三类不同来源模型:自家开源小参数量模型 GPT‑OSS 120B、DeepSeek 第三方模型,以及 Moonshot AI 的 Kimi K2.5 1T。其中在万亿参数规模的 Kimi K2.5 1T 之上,Jalapeno 的性能优势表现得更为突出。万亿参数模型对内存带宽、芯片互联效率要求极高,历来被视作英伟达 GPU 生态的优势场景。倘若 Jalapeno 在这类高负载极端场景优势进一步拉大,侧面说明它的架构设计在大规模模型推理上具备结构性优势,有可能来自优化的片上内存层级、更高效的互联拓扑,或是面向 Transformer 架构的定向优化。OpenAI 布局自研芯片并非临时决策,是整套算力战略的关键一环。梳理完整逻辑链,便能看懂算力寡头化的形成路径:第一环,需求端的规模扩张。从 GPT‑4 到 GPT‑5,再到未来更大体量的多模态模型,OpenAI 训练与推理需求持续指数级上涨。高度依赖外部芯片供应商,就意味着产能、定价、交付周期全部受制于人。第二环,供给端锁定电力资源。OpenAI、Anthropic 通过大规模签约锁定数据中心与电力配额,前文提及的吉瓦级算力增量,已有相当部分被两家企业提前锁定。第三环,效率端依靠芯片实现增益。锁定电力解决的是算力供给有无问题,自研芯片则解决资源利用效率。一旦自研芯片能效比肩甚至超越英伟达同级产品,同等电力配额就可以输出更多算力,相当于对已锁定能源实现系数放大。第四环,生态端完成垂直整合。当 OpenAI 同时掌控模型、芯片、数据中心三层能力,它就不再只是英伟达的大客户,而是一家垂直一体化算力供给方。企业可以完成从底层硬件到上层推理的全链路调优,这也是 Jalapeno 能够在部分场景超越 GB300 的核心原因:并非芯片单体硬件绝对领先,而是硬件针对自身业务负载做定制化适配。四环环环相扣形成正向飞轮:规模优势锁定能源供给→自研芯片放大资源利用效率→效率提升拉高实际算力产出→算力产出巩固市场地位→市场地位继续扩大规模。算力集中叠加头部企业自研芯片浪潮,将对整条 AI 产业链带来深层次影响。第一重冲击,作用于英伟达。短期来看英伟达行业地位不会被颠覆,GB300 依旧是行业标杆,CUDA 生态护城河依旧坚固。但核心大客户已经显露出自主化趋势,将从两个维度影响英伟达长期估值:一方面高端芯片增量需求会被自研方案分流;另一方面英伟达在产品定价、路线规划上的绝对话语权会被制衡。英伟达同样有所预判,加码自研大模型、探索 ARM 架构,本质也是向垂直整合方向延伸布局。第二重冲击,指向云服务商。传统模式下云厂商是 AI 算力批发商,采购英伟达 GPU 之后以云实例对外售卖,供给模型企业与开发者。但当最大一批客户开始自建数据中心、开发自研芯片,云厂商的定位变得微妙。微软绑定 OpenAI、亚马逊绑定 Anthropic,本质是云厂商以基础设施投资换取股权与长期合约,规避被边缘化风险。而未能绑定头部大模型企业的云服务商,或将面临高端 GPU 采购需求增速放缓的压力。第三重冲击,落在中小模型企业与开源社区。算力向头部聚拢,抬高了后入局者做基础大模型的追赶门槛。先进硬件、低成本电力、芯片设计能力向少数企业汇集,新玩家想要在基础模型赛道实现突破,难度显著提升。行业分层会进一步加剧:头部企业深耕基础大模型,中小企业转向垂直行业、端侧模型以及应用层创新。开源模型的价值会进一步凸显,为资源有限的开发者提供创新底座。对普通用户而言,这一变化未必全然是负面。推理成本下行会向消费端传导:ChatGPT 不一定直接降价,但同等订阅费用下可调用的能力会显著增强;过往付费用户专属的深度研究、高级 Agent 能力,未来有望向免费用户开放;企业 API 调用成本下降,更多中小企业、开发者能够用上过去只有大客户可负担的 AI 能力,推动 AI 进一步普及。回到 Dylan Patel 的预判:2028 年全球大部分 AI 算力将归属两家企业。该预测的价值不在于数字精准度,而是揭示一条不可逆趋势:AI 基础设施正在从 “分散供给、通用采购”,转向 “集中建设、垂直整合”。OpenAI Jalapeno 芯片的出现,正是这一产业转向的标志性事件。它证明头部模型企业,既可以定义算法,同样有能力定义承载算法运行的硬件。当算法创新与硬件创新在企业内部完成闭环,算力规模和能效提升持续驱动正向飞轮,整个 AI 产业的竞争门槛将抬升至全新层级。站在全行业视角,这既是技术效率的胜利,也暗藏创新多样性下降的隐忧。算力集中能够加速技术迭代,但也有可能挤压多元创新空间。未来数年行业将迎来关键博弈:集中模式带来的效率红利,与去中心化带来的创新活力,能否在 AI 基础设施层面找到新的平衡点。而寻找这个平衡点的线索,或许就藏在这些实验室中敢于对标 GB300 的自研芯片身上