扫码体验VIP
网站公告:为了给家人们提供更好的用户体验和服务,股票复盘网V3.0正式上线,新版侧重股市情报和股票资讯,而旧版的复盘工具(连板梯队、热点解读、市场情绪、主线题材、复盘啦、龙虎榜、人气榜等功能)将全部移至VIP复盘网,VIP复盘网是目前市面上最专业的每日涨停复盘工具龙头复盘神器股票复盘工具复盘啦官网复盘盒子股票复盘软件复盘宝,持续上新功能,目前已经上新至V6.5.7版本,请家人们移步至VIP复盘网 / vip.fupanwang.com

扫码VIP小程序
返回 当前位置: 首页 热点财经 中信建投:国产模型密集发布-GLM 5.3、DeepSeek V4 Pro

股市情报:上述文章报告出品方/作者:中信建投证券研究;仅供参考,投资者应独立决策并承担投资风险。

中信建投:国产模型密集发布-GLM 5.3、DeepSeek V4 Pro

时间:2026-08-17 07:17
上述文章报告出品方/作者:中信建投证券研究;仅供参考,投资者应独立决策并承担投资风险。

模型竞争从能力强延展至产品好用,继续看好开源模型与AI应用;Q2财报密集发布中,重点关注。本周腾讯资本开支确认加速,模型迭代竞争激烈,开源、闭源模型的价格进一步收敛。

1/模型竞争从单点能力转向“模型 × Harness × 工作流”,DeepSeek  Harness推出,智谱Zcode用户突破100万,智谱同步为全部GLM Coding Plan用户重置额度。

2/腾讯:算力投入进入加速拐点。

3/MiniMax:海螺3调用份额持续提升,开源形成产品迭代正循环。

1、行业观点

模型竞争从能力强延展至产品好用,继续看好开源模型与AI应用;Q2财报密集发布中,重点关注。本周腾讯资本开支确认加速,模型迭代竞争激烈,开源、闭源模型的价格进一步收敛。

1/模型竞争从单点能力转向“模型 × Harness × 工作流”.

本周 Grok 4.6、DeepSeek V4 Pro、智谱 GLM 5.3、Qwen3.8-27B 密集发布;xAI 同步推出 Grok Bot ,DeepSeek 发布高度插件化的官方 Harness。模型能力仍是底座,但开发环境、工具调用、端到端任务完成率和分发入口正成为决定调用量的新变量。

2/2Q26 腾讯的资本开支 527.84 亿元,资本开支付款 593 亿元,自由现金流首次转负为 -138 亿元。腾讯传统业务经营杠杆仍强,新增算力优先投向混元、WorkBuddy 和小微;管理层明确后续资本开支与 Token 变现、算力出租等回报挂钩,当前投入高峰不应线性外推。

3/MiniMax:海螺3调用份额持续提升,开源形成产品迭代正循环

OpenRouter视频请求口径下,海螺 3 份额从 7/27—8/2 的 0.73%升至 8/3—8/9 的 4.52%,8/12 最新 24 小时进一步升至 6.25%。官方 AMA 披露后续计划开放 Regenerate-2K 模块,并发布、开源统一图像生成/编辑模型;当前开放包仍以基础 768p 为主。我们认为,“能力升级—开源扩散—调用份额提升”的正循环正在形成。

2、全球AI产业进展

大模型:GLM 5.3发布,通过后训练再次强化Coding能力;GPT 5.6 Sol高速版推出

本周重点更新

GLM 5.3沿用5.2基座,重点扩大后训练,提升Coding Agent能力。官方表示代码能力提升约 50%,并公布 Terminal-Bench 3.0 由 4.6升至 28.3、DeepSWE 由 46.2升至 66.9、SWE-Marathon 由 19.4升至 42.5、AutomationBench 由 26.2升至 48.2 等结果。

Grok 4.6 AA智能评分与GPT-5.6 Sol Max齐平,定价与Grok 4.5一致。据官网,AA智能指数分数61,与GPT-5.6 Sol Max一致,较比Fable 5 Max低一分。具体看跑分,知识工作与应用开发能力突出,专业知识工作(GDPVal-AA)、代码开发(CursorBench 3.2/FrontierCode)、及复杂Agent任务(APEX-Agents)评分高于GPT-5.6 Sol。相较Grok 4.5,重点提升了long-run agent,更复杂的交互和视觉能力

8月13日,OpenAI推出GPT 5.6 Sol Ultrafast模式,最高速度可以达到Sol标准版的14倍。由Cerebras提供推理能力,最高750 output tokens/s,目前API面向少量客户开放。

继续关注年内模型迭代:

1、GLM 5.5年内有望发布,预计参数过万亿。

2、MiniMax M3大参数版本有望9-10月发布。

3、马斯克X发帖:Grok 4.6将于8月7日发布

4、GPT 6、Qwen 4、Hy4有望Q3发布。

5、继续关注Gemini 3.5 Pro的发布节奏。

商业化:DeepSeek涨价,模型竞争从能力延展至产品的趋势突出

本周重要更新

1/8月14日,DeepSeek宣布V4 Pro与Flash提价,输出价格翻倍以上增长。官方价格页显示,V4 Pro 空闲时段缓存未命中输入/输出为 4.5/13.5 元,高峰 9/27 元;V4 Flash 空闲 1.5/4.5 元,高峰 3/9 元。相较旧价,空闲时段 Pro 输入 50%,输出  125%。高峰时段为 9:00—12:00、14:00—18:00。Grok 4.6输入/输出价格与Grok 4.5一致,8月13日Grok 4.6发布,每百万token输入/输出2/6美元,分别为GPT-5.6 Sol定价的40%、20%。Grok 4.6高速版价格为标准版的2倍。

2/8月14日,DeepSeek发布DeepSeek Harness开发者预览版,产品高度灵活,整个工作流程、模型、工具等Agent能力均可以灵活调整。

Token:本周OpenRouter调用量环比增长8.4%以上,周度调用再创新高

本周(8.10-8.16)预计Token调用74.8万亿,环比 8.4%,周度调用再创新高。本周DeepSeek V4 Flash正式版的token调用保持排名第一,GPT-5.6 Luna榜单排名升至第3,上周为第5。本周排名前5中4名为国产开源模型,分别为DeepSeek V4 Flash 0731、Hy 3、GPT-5.6 Luna、DeepSeek V4 Flash 0423。

OpenRouter周度token调用中,本周开源模型占比79.4%,中国开源模型占比79.4%(由于数据可得性,仅统计调用量top9,数据截取时本周统计时间窗口未完全覆盖,目前为非完全统计)。近2周开源模型占比下滑,主要系GPT 5.6 Luna大幅降价后token调用快速增长,其为闭源模型。

本周token市场份额(ZenMux口径),DeepSeek调用占比继续提升,本周占比超过50%。据ZenMux(大模型聚合平台)的统计,本周DeepSeek市场份额53.6%,排名第一,自DeepSeek V4 Flash正式版发布后,其token调用占比提升显著,近3周分别环比 11.7/ 14.2/ 5.0pcts;Anthropic本周排名第二。

1)AI模型迭代快于商业化变现的风险:国产模型密集发布但企业级付费转化和C端订阅渗透仍需培育,技术能力与变现节奏可能形成剪刀差。

2)AI短剧内容同质化与爆款率低迷的风险:上半年AI短剧上线超12万部但播放量破百万不足10%,产能爆发与爆款稀缺并存,存量博弈下变现效率承压。

3)算力与上游硬件成本持续上行的风险:海外CSP资本开支合计约7250亿美元,DRAM现货价格环比涨约40%,AI内容生产成本结构短期难改善。

4)AI生成内容版权界定模糊与监管收紧的风险:训练数据版权、生成内容归属等法律边界尚不清晰,重大版权判决或监管收紧可能影响业务节奏。

5)传统内容公司AI改造投入产出不确定的风险:工作流重构和团队培训短期推升成本,若AI未显著降本或提升爆款率,利润率拖累将持续2-3年。

6)海外AI竞赛引发出口管制升级的风险:中美AI竞争背景下,若管制波及TPU、HBM等关键环节,国内模型训练效率和内容生产成本将受影响。

7)AI变现路径多元但单点贡献仍小的风险:多数公司AI业务收入占比不足10%,若2027年前未提升至20%以上,概念溢价向业绩验证切换时估值承压。

8)行业从流量驱动向内容驱动切换的阵痛风险:产能爆发但内容质量和叙事深度仍待提升,中小团队可能因跟不上转型节奏而批量出清,格局波动加大。

股票复盘网
当前版本:V3.0