扫码体验VIP
网站公告:为了给家人们提供更好的用户体验和服务,股票复盘网V3.0正式上线,新版侧重股市情报和股票资讯,而旧版的复盘工具(连板梯队、热点解读、市场情绪、主线题材、复盘啦、龙虎榜、人气榜等功能)将全部移至VIP复盘网,VIP复盘网是目前市面上最专业的每日涨停复盘工具、龙头复盘神器、股票复盘工具、复盘啦官网、复盘盒子、股票复盘软件、复盘宝,持续上新功能,目前已经上新至V6.5.7版本,请家人们移步至VIP复盘网 / vip.fupanwang.com

扫码VIP小程序
返回 当前位置: 首页 热点财经 【国金计算机&科技】AI产业三线共振:模型迭代、Agent落地与国模出海

股市情报:上述文章报告出品方/作者:国盛证券,刘高畅/顾晟等;仅供参考,投资者应独立决策并承担投资风险。

【国金计算机&科技】AI产业三线共振:模型迭代、Agent落地与国模出海

时间:2026-09-27 16:43
上述文章报告出品方/作者:国盛证券,刘高畅/顾晟等;仅供参考,投资者应独立决策并承担投资风险。






摘要





本周观点:

前沿模型密集迭代,专业任务能力持续提升。OpenAI同时推出GPT-6 Sol和Luna:Sol面向复杂编程和Agent工作流,这类任务需要规划、调用工具并验证结果;Luna则更偏向边界清楚、调用频繁的轻量任务。Anthropic发布Claude Opus 5.5,进一步强化长程编程和知识工作。三款模型均提供百万级上下文与12.8万Token最大输出,并支持网页搜索、文件搜索、代码执行和电脑操作等工具。异步工具调用和执行中追加指令,使模型能够在工具运行期间处理独立工作,并根据用户反馈及时调整要求。Opus 5.5在编程和电脑操作评测中较前代提升,代码迁移与季度业绩报告测试也体现了其处理长工程任务和资料密集型工作的潜力。Sol、Luna的标准Token价格低于前代,Opus 5.5典型工作负载成本也有所下降,能力与成本的共同改善有望提升Agent工作流的经济性。
个人Agent走向终端,C端应用进展突破。Meta Muse运行于配有浏览器的独立安全虚拟电脑,用户可通过Muse应用或WhatsApp以自然语言委托任务。在返校准备场景中,Muse能够查看学校邮件和学区网站,将日期加入家庭日历,把用品放入购物车,并完成餐厅查找及报名提醒。它还可根据食谱整理采购清单,结合饮食限制提出建议,并按需生成支出追踪工具、学习指南和睡眠看板。Muse支持在用户关闭应用后继续工作,按照计划或相关事件推进任务,在出现重要变化或需要输入时通知用户。读取与写入权限的区分、Sentinel检查及敏感操作前的用户确认,为Agent进入邮件、日历和交易等场景提供了可控基础。Meta将Muse引入AI眼镜,国内豆包手机助手消费者版也随努比亚机型发布,个人Agent正在获得更贴近日常习惯的终端入口。若任务完成率和用户信任持续提升,消费级AI的付费依据有望进一步落到节省时间和完成事务上。
Kimi K3登陆AWS,国产模型拓展全球分发渠道。AWS宣布月之暗面Kimi K3在Amazon  Bedrock正式可用,面向编程和知识工作提供托管调用,并被纳入开放权重模型服务体系。海外云平台能够提供企业客户触达、部署和调用渠道,帮助国产模型降低独立拓展海外市场的接入门槛。企业客户对接入便利和服务稳定的需求,也可能为托管调用带来付费空间。若kimi的海外调用与合作模式得到验证,其他具备模型能力、推理成本及服务交付优势的国产开放权重模型,也有望通过云平台托管及分成合作拓展海外商业化空间,形成国内应用与海外企业服务共同发展的收入来源。
相关标的

国内算力:寒武纪、海光信息、长鑫科技、东阳光、利通电子、中芯国际、华虹半导体、华达科技、亿田智能、摩尔线程、天数智芯、沐曦股份、壁仞科技、协创数据、禾盛新材、华丰科技、京基智农、中科曙光、浪潮信息、胜蓝股份、华勤技术、盛视科技、神州数码、润泽科技、大位科技、科华数据、潍柴重机、欧陆通、杰创智能、奥尼电子等。

海外算力:工业富联、中际旭创、胜宏科技、生益科技、东山精密、新易盛、海鸥股份、方正科技、天孚通信、联瑞新材、蓝思科技、光智科技、江海股份、鹏鼎控股、中钨高新、奥士康、光迅科技、华盛昌、联讯仪器、领益智造、飞龙股份、大元泵业、德福科技、南亚新材、景旺电子、生益电子、深南电路、沪电股份、海亮股份、英维克、鼎泰高科、欧科亿、先导基电、云南锗业、源杰科技、唯科科技、海川智能、冰轮环境、麦格米特、三环集团、火炬电子、海星股份、新锐股份、杰美特、欧陆通、四方股份、阳光电源、天岳先进等;SK海力士、英特尔、英伟达、Lumentum、闪迪、铠侠、美光、Bloom Energy。

大模型&云:智谱、MiniMax、阿里巴巴、腾讯控股、金山云、百度集团、优刻得、网宿科技等。
AI应用:深信服、德才股份、迈富时、汇量科技、卓易信息、鼎捷数致、达梦数据、中控技术、金蝶国际、用友网络、海致科技集团、汉朔科技、金山办公、合合信息、福昕软件、金斯瑞生物科技、晶泰控股-P、英矽智能等。


+

风险提示


行业竞争加剧的风险;技术研发进度不及预期的风险;特定行业下游资本开支周期性波动的风险


报告正文:


01 前沿模型密集迭代,专业任务能力持续提升


1.1 海外前沿模型同日更新

9月22日,OpenAI推出GPT-6 Sol、Luna,并开始向Codex及ChatGPT Work用户开放;Anthropic同日发布Claude Opus 5.5。OpenAI将Sol定位于复杂编程和Agent工作流,Luna侧重范围明确、高频调用的任务;Anthropic则将Opus 5.5定位于长程编程与知识工作。
GPT-6 Sol侧重需要规划、工具调用和结果验证的复杂任务。OpenAI的模型选择说明将Sol用于需求存在一定模糊性、需要多步骤执行并在较大上下文中持续推进的Agent任务。这一定位更贴近实际软件工程中的复杂需求:模型需要先理解已有项目,再拆解任务、修改代码并检查结果,任务价值取决于能否完成整个过程。Sol有望成为兼顾任务质量与调用成本的主力模型,为复杂开发及专业工作流提供更具经济性的能力选择。
GPT-6 Luna侧重快速、边界清晰且可重复执行的工作。OpenAI在子Agent配置说明中建议,将Luna用于快速扫描及较轻量的子任务,并将其作为更快、成本更低的选择。我们认为,这种分层有利于在同一工作流中按任务难度分配模型,将资料初筛、结构化整理等高频环节交给轻量模型,复杂判断交由能力更强的模型处理,在保留关键环节质量的同时控制整体成本。
工具支持方面,Sol、Luna均提供105万Token上下文窗口及12.8万Token最大输出,支持文本、图像输入,以及网页搜索、文件搜索、代码执行和电脑操作等工具。GPT-6系列的API文档还介绍了异步工具调用与执行中追加指令:模型可在工具运行期间继续处理其他独立工作,用户也可在执行过程中修正要求。我们认为,长上下文、视觉输入与多种工具的结合,有望使模型围绕同一任务处理代码、网页和文档;执行中调整要求,则更接近实际工作中边推进、边沟通的协作方式。
Claude Opus 5.5强化长程执行与专业知识工作。根据Anthropic模型文档,Opus 5.5提供100万Token上下文窗口、常规12.8万Token最大输出,并持续启用自适应思考,可通过推理强度设置调节思考深度。对于持续时间较长、需要反复读取资料和调用工具的工作,模型能否保持目标、处理任务间依赖并检查中间结果,将直接影响最终交付质量。
从Anthropic公布的同表评测看,Opus 5.5在编程测试Terminal-Bench 4.0中的成绩为66.4%,Opus 5为52.3%;电脑操作测试OSWorld 2.0的部分得分口径分别为81.8%和74.0%。其中,Opus 5.5的Terminal-Bench成绩采用xhigh推理强度。
具体任务案例方面,Anthropic披露,一名早期测试者使用Opus 5.5在不到一天内完成了涉及68万行代码的迁移。在公司季度业绩报告的内部测试中,模型需从较难检索到财报的网页环境中查找资料并撰写报告,18次输出中有16次通过了对数字及引用真实性的质量检查。这些案例体现了模型承担较长工程任务和资料密集型工作的潜力,编程之外的研究、财务及办公任务有望成为能力扩展的重要方向。
1.2 模型调用价格同步下调
OpenAI披露,Sol、Luna的Token价格低于各自GPT-5.6前代产品;按标准处理、输入不超过27.2万Token的API价格,Sol每百万输入、输出Token分别为2美元、10美元,Luna分别为0.1美元、0.5美元。Opus 5.5的常规输入、输出价格分别为每百万Token 4美元、20美元,缓存读取为0.2美元。Anthropic表示,在默认设置下,其典型工作负载测试中Opus 5.5的运行成本较Opus 5降低40%。
1.3 能力与成本共振拓宽Agent任务边界
我们认为,单次任务成本下降,有望提高包含多轮推理、工具调用及结果校验的Agent工作流的经济性,使更多原本成本较高的任务具备应用条件。前沿模型竞争正进一步延伸至持续执行任务,Sol、Luna扩大不同成本预算下的任务覆盖,Opus 5.5强化复杂任务执行,能力与效率的共同改善有望拓宽Agent可承担的工作范围


02 个人Agent走向终端,C端应用进展突破


2.1 Muse切入C端,个人Agent走向持续执行

9月8日,Meta发布个人Agent产品Muse。根据官方介绍,Muse运行于配有浏览器的独立虚拟电脑Muse Secure VM,可跨日常应用执行任务;用户可在Muse应用或WhatsApp中与其沟通,无需具备技术经验。我们认为,将运行环境和工具操作整合到产品内部,有望让非专业用户通过自然语言直接委托事务,降低持续使用Agent的门槛。
家庭事务是Muse产品团队展示的具体应用场景。在返校准备案例中,团队成员让Muse持续查看学校邮件和学区网站,将重要日期加入家庭日历,把所需用品放入购物车,并查找孩子想要的打折卫衣、预订庆祝开学的晚餐。Muse还从邮件中发现了一项即将截止的体育选拔报名,并主动发出提醒,家人随后完成了表格提交。这类需求包含信息筛选、日期提取、购物与预约等多个环节,个人Agent有望减少用户在邮件、日历和购物网站之间反复切换的时间。
Muse可根据用户偏好协助准备聚餐。Meta给出的场景是,Muse可将用户在Instagram收藏的食谱视频整理为食材采购清单,为聚餐提出菜单建议,并记住朋友的饮食限制。我们认为,个人偏好与实际任务相结合,有望减少每次使用时重复补充背景的负担,使Agent在持续互动中逐步适应用户的日常安排。
日常管理工具也可由Muse按需生成。产品设计说明列举了支出追踪工具、交互式学习指南和用于观察睡眠规律的看板等输出形式,并介绍Muse可以生成文档、PDF和网页。这意味着非专业用户有望直接提出管理目标并获得可使用的工具,例如围绕个人支出或学习计划组织信息,AI编程能力因而能够通过消费级产品服务于更广泛的人群。
Muse支持后台持续执行。Meta介绍,Muse可在用户关闭应用后继续工作,按照计划或相关事件推进任务,并在出现重要变化或需要用户输入时通知用户。我们认为,对于报名提醒、日程管理和长期计划等需求,Agent能否持续跟进比单次回答是否完整更为重要,有望推动使用关系从临时问答延伸为长期事务委托。
在操作权限方面,Meta的安全说明指出,用户可区分邮件等服务的读取与写入权限,Sentinel负责判断连接器操作及网络请求是否允许执行;需要审批时,操作会暂停并由用户确认。我们认为,个人Agent要进入日历、邮件及交易等场景,需要让用户能够理解并控制其行为,权限管理和结果可检查性将影响用户愿意委托的任务范围。
终端入口仍在扩展。9月23日,Meta在Connect期间宣布将Muse引入AI眼镜,使用户能够以免手持方式与个人Agent交互,官方列举的方向包括健康习惯管理和繁忙日程安排。眼镜等随身设备有望降低发起任务的操作成本,让个人Agent更自然地参与出行、家庭和日常事务,也为模型能力转化为消费级服务提供更多入口。
相较于Codex、Claude Code等产品所代表的专业任务使用路径,Muse的核心产业意义在于,将跨应用操作、持续执行及个性化记忆整合为面向非专业用户的服务。我们认为,家庭事务、采购准备与个人管理工具等案例说明,Agent的潜在需求并不限于编程和专业办公,普通用户日常生活中分散、重复、需要跟进的事务,同样可能形成稳定的使用场景。若实际任务完成率及用户信任持续提升,C端AI应用的付费依据有望进一步落到节省时间和完成事务上。
2.2 手机助手落地,个人Agent加速进入大众消费场景
国内方面,据红星资本局9月14日报道,豆包手机助手消费者版正式发布,首款搭载机型为努比亚NaviX Ultra;据《科创板日报》9月16日报道,该机型已正式上市开售。我们认为,系统级手机助手为个人Agent提供了更贴近日常使用习惯的入口,有望推动相关能力向大众消费场景渗透。

03 Kimi K3登陆AWS,国产模型拓展全球分发渠道

    9月18日,AWS宣布月之暗面Kimi K3在Amazon Bedrock正式可用,面向编程和知识工作。AWS将K3纳入其开放权重模型服务体系,用户可通过平台调用。

    我们认为,海外云平台能够提供企业客户触达、部署及调用渠道,帮助国产模型降低独立拓展海外市场的接入门槛。开放权重与商业化并不矛盾,企业客户对部署便利、服务稳定性和运维支持的需求,有望为托管调用服务带来付费空间,模型厂商亦有机会通过相应合作安排获取收入。

    K3登陆Bedrock为观察国产模型海外商业化提供了新的样本,后续应关注实际调用需求、客户留存及合作收益能否形成持续贡献。若其海外调用与合作模式得到验证,其他具备模型能力、推理成本及服务交付优势的国产开放权重模型,也有望通过云平台托管及分成合作拓展海外商业化空间,形成国内应用与海外企业服务共同发展的收入来源。

    04 相关标的

      国内算力:寒武纪、海光信息、长鑫科技、东阳光、利通电子、中芯国际、华虹半导体、华达科技、亿田智能、摩尔线程、天数智芯、沐曦股份、壁仞科技、协创数据、禾盛新材、华丰科技、京基智农、中科曙光、浪潮信息、胜蓝股份、华勤技术、盛视科技、神州数码、润泽科技、大位科技、科华数据、潍柴重机、欧陆通、杰创智能、奥尼电子等。

      海外算力:工业富联、中际旭创、胜宏科技、生益科技、东山精密、新易盛、海鸥股份、方正科技、天孚通信、联瑞新材、蓝思科技、光智科技、江海股份、鹏鼎控股、中钨高新、奥士康、光迅科技、华盛昌、联讯仪器、领益智造、飞龙股份、大元泵业、德福科技、南亚新材、景旺电子、生益电子、深南电路、沪电股份、海亮股份、英维克、鼎泰高科、欧科亿、先导基电、云南锗业、源杰科技、唯科科技、海川智能、冰轮环境、麦格米特、三环集团、火炬电子、海星股份、新锐股份、杰美特、欧陆通、四方股份、阳光电源、天岳先进等;SK海力士、英特尔、英伟达、Lumentum、闪迪、铠侠、美光、Bloom Energy。

      大模型&云:智谱、MiniMax、阿里巴巴、腾讯控股、金山云、百度集团、优刻得、网宿科技等。

      AI应用:深信服、德才股份、迈富时、汇量科技、卓易信息、鼎捷数致、达梦数据、中控技术、金蝶国际、用友网络、海致科技集团、汉朔科技、金山办公、合合信息、福昕软件、金斯瑞生物科技、晶泰控股-P、英矽智能等。

      05风险提示

        行业竞争加剧的风险:

        云厂商、模型厂商及芯片企业降价或推出替代方案,可能压缩份额与利润率。
        技术研发进度不及预期的风险:
        模型能力、Agent稳定性、芯片迭代及液冷机架交付延期。
        特定行业下游资本开支周期性波动的风险:
        互联网云厂商、运营商、数据中心及金融、政府客户延后或削减AI服务器与算力基础设施投资。

        股票复盘网
        当前版本:V3.0