近日,月之暗面正式发布新一代模型Kimi K3。参数规模达到2.8万亿,是全球首个开源的2万亿 级别模型。7月27日前,完整模型权重将向全球开发者开放。
这不是一次常规的版本迭代——开源阵营第一次有人把模型规模推到2.8万亿,也是第一次有开源模型杀入全球综合榜单前三。


一、2.8万亿参数,到底有多大?
在K3之前,开源模型的最大参数规模停留在万亿级门槛附近。K3直接把天花板推到了2.8万亿。
但这个数字本身,可能反而掩盖了它真正的分量。
K3是一个MoE(混合专家)模型,拥有896个专家模块,每次推理只激活其中16个。这意味着,虽然模型“知道”的东西极多,但每次回答问题时调用的计算量被严格控制在较低水平。
支撑这一切的,是三项底层技术革新:
KDA混合线性注意力:将标准注意力机制的计算复杂度从平方级降到了线性,在100万上下文长度下,解码吞吐量提升到原来的6倍。
注意力残差:允许模型在深层直接跳回浅层提取原始特征,在长周期软件工程任务中保持“方向感”。
高稀疏度MoE:896个专家中只激活16个,在扩大模型容量的同时控制计算成本。
这些改进让K3相比前代K2的整体扩展效率提升了约2.5倍。

二、全球第三,开源模型的最高排名
参数大不等于能力强。但K3的评测成绩,证明了这个“大”是被充分榨取过的。
独立AI模型评测机构Artificial Analysis发布的“智能指数”显示,Kimi K3综合得分57分,位列全球第三,仅次于Claude Fable 5(60分)和GPT-5.6 Sol(59分),领先Claude Opus 4.8(56分)。
这是开源模型第一次进入该榜单前三。
在更具体的指标上:
Terminal-Bench 2.1:得分88.3,与GPT-5.6 Sol的88.8只差0.5分
FrontierSWE:得分81.2,仅次于Fable 5的86.6
Arena.ai前端能力:全球第一,超越Fable 5和GPT-5.6 Sol
知识工作评测GDPval-AA:得分1687,超越Claude Opus 4.8
加州大学伯克利分校教授、Databricks联合创始人Ion Stoica评价道:“我们过去常说,开源模型比最先进的模型落后六到九个月。可现在,这个差距大概只有两到三个月了。”
在实际体验中,K3展现出的能力更令人震撼。它可以在极少人工监督下持续完成长时间工程任务,理解和处理大型代码库。在测试中,它能自主完成GPU内核优化、从零构建GPU编译器,甚至独立设计出一款为其自身架构服务的芯片。有开发者用一张手绘草图就让K3生成了一款可玩的游戏。K3还能打通科学文献与可执行代码,自主完成复杂计算研究。
三、开源即炸场:服务器被挤爆,硅谷彻夜难眠
K3发布后的热度,远远超出了月之暗面的预期。
发布仅两天,K3的请求量就大幅超出预估,逼近现有算力集群的承载极限。7月19日,月之暗面不得不宣布暂停开放C端新用户订阅,将有限算力优先保障现有订阅用户。
在X、Reddit、OpenRouter等平台,大量开发者第一时间分享体验,K3几乎成为过去几天AI圈讨论最多的模型。
这种热度很快传导到了资本市场。
K3发布后首个交易日,英伟达单日市值蒸发约1111亿美元,与2025年1月DeepSeek发布时如出一辙。费城半导体指数本周下跌12.5%,创下15个月来最差单周表现。摩根大通策略师在报告中直接称之为 “DeepSeek 2.0”。
美国国家前AI事务负责人、现任总统科技顾问委员会联席主席大卫·塞克斯发文称,这是中国模型第一次在前端编程赛道拿下第一,照此以往,美国将输掉AI竞赛。
马斯克也在相关评测报道下留言“令人印象深刻(Impressive)”,随后表示xAI旗下最新大模型可能超越Kimi。
外媒Axios称,K3定价远低于它所挑战的高端模型,美国AI公司的高价策略还能维持多久?
写在最后
Kimi K3的意义,远不止于一个模型的发布。
长期以来,“开源模型整体落后闭源模型半代”几乎是行业共识。K3的出现,让这个差距从“半代”缩到了“两三个月”。一家中国公司的开源模型,在编程和长程推理这两个最硬的指标上,同时够到了全球顶尖闭源系统的肩膀。
有人把K3比作又一个“DeepSeek时刻”——开源AI正在第二次改写游戏规则。
但正如钛媒体所言:“K3不是全球科技股暴跌的肇事者,它是下一轮AI繁荣的报信人。”
当开源模型第一次摸到全球前三的门槛,整个AI产业的定价逻辑、竞争格局和估值体系,都需要被重新审视


VIP复盘网