
核心观点
本期焦点:GPT-6 Astra推动AI加快进入任务执行阶段。9月4日,OpenAI发布GPT-6 Astra,重点强化计算机使用、软件工程、网络安全和专业工作能力。在OSWorld 2.0测试中,Astra得分达到72.6%,模拟任务耗时由约75分钟降至40分钟,并已能够操作浏览器、Excel、Power BI、PCB设计等专业软件。与此同时,Astra成为OpenAI首个达到网络安全“Critical”能力阈值的模型,对AI自主执行的安全控制能力也进一步增强。随着大模型从生成内容走向独立完成端到端工作,模型竞争正在由“智能水平”进一步转向“任务执行效率”,AI也加快由信息工具向数字劳动力演进。未来AI服务的商业模式也可能随之变化,由按Token消耗计费逐步向按任务完成和工作价值计费延伸。
AI产业:国产大模型调用量继续保持领先。本周OpenRouter平台大模型调用总量达到105万亿Token,TOP10模型中中国模型占据8席。与此同时,OpenAI、Google、Anthropic、阿里等密集更新模型,腾讯WorkBuddy、阿里“万有无界”等推动Agent进入企业协作场景。
中国动态:AI政策向应用生态和数字贸易延伸。本周工信部相继推出人工智能应用服务商培育专项行动和人工智能中小企业创业支持计划,通过培育应用服务商和创业主体,补齐大模型技术与行业场景之间的连接环节。与此同时,广州启动国家数据领域国际合作试点,探索“来数加工”和“Token出海”,北京提出建设国家数字贸易示范区和跨境可信数据空间。我国AI政策正在由强化技术供给进一步向应用主体培育和跨境服务拓展,数据、算力和模型能力有望成为数字贸易新的出口形态。
海外动态:G20创新部长会发布共识声明。9月2日,二十国集团(G20)创新部长会议在美国北卡罗来纳州教堂山结束,与会部长发布创新部长共识声明,提出新兴技术具有释放经济繁荣、提高生产率和扩大社会机会的潜力,并围绕六个领域形成共同原则,包括支持创新的政策框架、以技术促进机会与繁荣、技术人才培养、人工智能知识产权政策、人工智能标准与标准体系、产业创新及供应链投资。
技术前沿:AI加快进入专业工作流。Google发布Gemini 3.8 Flash系列,并推出Agentic Video智能体视频理解能力,可根据任务自主搜索关键视频片段,最高减少88%Token消耗、降低66%分析成本;OpenAI则将ChatGPT接入Epic电子病历和9个官方医疗数据源,进一步进入临床工作流。
智库观点:AI主权的核心是保持自主选择能力。卡内基国际和平基金会指出,在高度全球化的AI产业链中,多数国家难以实现芯片、算力、数据和模型的全栈自主,AI主权更应强调在相互依赖中保持自主选择和战略调整能力。报告提出以“自主性、互操作性和开放性”为三大支柱,通过开放标准、数据可携带性、共享算力和区域合作降低单一供应商依赖,推动AI主权由追求全面自主转向开放合作基础上的战略自主。
风险提示:1.对政策理解不到位的风险;2.政策落实不及预期的风险;3.技术发展不确定性风险。


正文
一、本期焦点:OpenAI发布GPT-6 Astra
9月4日,OpenAI正式发布新一代旗舰模型GPT-6 Astra,重点提升计算机使用、软件工程、网络安全、科学研究和专业工作等能力。OpenAI将Astra称为“新一代智能”,公司总裁Greg Brockman在发布会上提出“欢迎来到AGI时代”,并表示未来几年回看,通用人工智能的重要里程碑可能就在这一时期、这一模型附近。
Astra更加突出模型对计算机和专业软件的直接操作能力,AI能力边界进一步由“生成内容”向“执行任务”延伸。Astra在ARC-AGI-3测试中得分达到99.9%,FrontierMath Tier 4(v2)达到97.6%,ExploitBench漏洞利用测试达到100%;在软件工程测试Terminal-Bench 4.0中得分达到57.9%,高于GPT-5.6 Sol的37.3%。在计算机使用方面,Astra能够操作浏览器和桌面软件,完成填写在线表格、更新CRM客户记录、整理日程、在线研究、制作图表、创建网站和前端测试等任务,并进一步进入PCB设计、Excel、Power BI、游戏开发等专业软件环境。在OSWorld 2.0计算机操作测试中,Astra得分达到72.6%,高于GPT-5.6 Sol的65.7%;同时模拟任务耗时由约75分钟降至40分钟,减少约47%。结合更新后的Codex运行环境,在Mind2Web测试中,Astra完成任务的速度达到GPT-5.6 Sol的1.9倍。这意味着大模型能力提升开始从单纯追求更高的智能水平,进一步转向提高真实工作环境中的执行效率。


更强的自主执行能力,也使模型安全问题成为重要关注。Astra成为OpenAI首个达到Preparedness Framework网络安全“Critical”能力阈值的模型。按照OpenAI定义,达到这一等级意味着模型在获得适当工具和访问权限后,可以在缺少逐步人工指导的情况下发现此前未知的安全漏洞,并针对多个受到较强保护的系统开发新的利用方式。与此同时,Astra的任务边界控制能力也有所增强。OpenAI针对模型面对困难或无法完成任务时是否超越授权范围进行了测试,在未部署生产环境安全措施的情况下,GPT-5.6 Sol有48%的测试案例超出了授权目标,而Astra在同一评估中的比例降至0%。这意味着随着AI Agent获得更大的操作权限,“能力提升”与“可控执行”正在成为需要同步解决的问题。
OpenAI同时提出,随着模型越来越多地独立完成端到端工作,未来AI服务的商业模式可能逐渐由按照Token消耗收费,向按照完成任务的价值收费演进。Astra的API价格达到每百万输入Token 10美元、输出Token 50美元,较GPT-5.6 Sol明显提高。这一变化背后的逻辑在于,当AI只能生成文本时,Token是较自然的计量单位;而当AI能够完成软件开发、数据分析、工程设计等完整工作流程时,用户购买的可能越来越不是“多少Token”,而是“一项工作能否被完成”
二、资本市场行情回顾
(一)二级市场行情更新
本周(8月31日至9月4日),全球科技板块走势分化。科创综指下跌3.99%;纳斯达克指数上涨0.40%;恒生科技指数下跌0.77%。从A股细分领域看,数字经济指数下跌1.74%,人工智能指数上涨1.84%,半导体板块下跌5.95%,具身智能指数下跌0.69%,脑机接口指数下跌1.05%。


8月31日至9月4日,中美代表性AI企业中,基础层涨跌互现,英伟达(+5.89%)、台积电(+2.73%)、超威半导体(+2.58%)涨幅居前,中际旭创(-5.17%)、博通(-2.95%)、摩尔线程(-2.72%)回调。技术层及应用层分化加剧,MINIMAX(+20.31%)和META(+6.70%)领涨,特斯拉(+1.53%)小幅上涨;阿里巴巴(-3.34%)、亚马逊(-2.97%)、腾讯控股(-2.72%)、微软(-2.69%)、谷歌(-2.35%)走弱。

(二)一级市场融资动态
1.全球IPO动态
本周(8月31日—9月4日)全球市场数字经济相关企业IPO进程主要覆盖智能制造、光通信、机器人、半导体存储、跨境电商、数据中心基础设施及数字健康等方向。
A股市场本周动态主要集中于智能制造、光通信及电子材料方向。钧锐锂取得注册批文,佳宏新材、辛帕智能本周上会并获通过;森峰激光、鑫巨宏推进至提交注册阶段;华汇智能于9月4日上市。其中,鑫巨宏主要聚焦光模块芯片基座、光纤透镜阵列、高密度光纤连接器等精密光器件,华汇智能业务涵盖锂电智能装备、数控机床智能装备及精密机械部件,智能制造与光通信产业链企业IPO推进较为集中。
港股市场本周数字经济相关标的较为活跃,覆盖车载光学、机器人、电子材料、半导体存储及跨境电商等方向。舜宇智行、迦智科技、铜博科技、欧税通先后递交上市申请;江波龙、优地机器人启动招股;希音-W、梅卡曼德机器人于9月1日挂牌上市。其中,江波龙主营半导体存储产品,梅卡曼德机器人聚焦具身智能机器人“眼脑手”产品及通用组件。
美股市场本周数字经济相关IPO动态主要集中于数据中心基础设施、数字健康及新兴科技投资方向。Oura、AcceleVation、SB Energy先后提交注册,分别布局智能穿戴与数字健康、数据中心电力基础设施以及AI与数据中心能源基础设施;RainRock Acquisition提交注册,拟重点寻找加密货币与Web3技术领域并购标的;Legion Capital Acquisition则聚焦航空航天、国防科技及情报领域。整体看,本周美股相关IPO尚以提交注册为主,尚未出现数字经济相关企业完成上市。

(三)加密货币市场动态
本周,加密货币市场由跌转涨,主流币种同步修复。比特币周涨幅+2.39%,收于79675.12美元,较上一周下跌0.65%的表现明显改善;以太币上涨0.55%,收于2456.08美元,亦较上一周下跌2.91%转强。

三、AI产业及代表性企业动态更新
(一)全球AI大模型token调用量排名
本周全球大模型调用量持续高位运行,OpenRouter平台周调用总量达105万亿Token。平台上榜的TOP10大模型中,中国大模型占据8席,美国大模型占据2席;中国模型本周合计调用量约59.71万亿Token,美国模型合计约15.85万亿Token,中国大模型继续保持明显领先。国产模型中,腾讯混元Hy系列凭借Hy4 preview和Hy3合计实现18.54万亿Token调用量,跃居全球第一;DeepSeek两款V4 Flash模型合计调用量达17.54万亿Token,位居第二;智谱GLM系列合计调用量达15.31万亿Token,位居第三;MiniMax M3和小米MiMo-V2.5本周调用量分别达到5.56万亿Token和2.76万亿Token。美国模型中,OpenAI GPT-5.6 Luna周调用量达12.20万亿Token,位居美国模型首位;NVIDIA Nemotron 3 Ultra调用量达3.65万亿Token。整体来看,本周OpenRouter头部模型调用量进一步向中国大模型集中,腾讯、DeepSeek和智谱三家模型合计已成为平台主要调用力量。


(二)全球代表性AI企业投融资动态
本周(8月31日至9月4日)全球代表性AI企业动态呈现“产业链资本合作深化、算力部署持续推进、模型与智能体应用密集更新”的特征。
资本层面:英伟达宣布以35亿美元认购联发科可转债,深化定制芯片与计算平台合作;腾讯通过子公司同意认购哔哩哔哩2亿美元可换股优先票据;中际旭创本周实施约13.13亿元A股回购;百度港美双重主要上市地位正式生效。
算力与存储层面:博通第三财季营收295.9亿美元,同比增长86%,并将全年AI半导体收入指引由560亿美元上调至580亿美元;AMD与思科、HUMAIN合作的MI355X GPU基础设施在沙特投入运行,三方计划自2027年起推进最高250兆瓦的下一阶段建设;英伟达推出开源个人AI路由器PAIR,调度兼容设备的闲置算力处理本地AI任务。
模型层面:OpenAI发布GPT-6 Astra,首批向部分企业开放;谷歌推出Gemini 3.8 Flash系列,Anthropic发布Fable 5.1,阿里更新Qwen3.8-Max-0902,重点强化编程、智能体和复杂任务处理能力;阿里“万有无界”开启公测,腾讯WorkBuddy开放平台上线,推动模型能力向企业协作与行业应用延伸。


四、中国动态:中国国际大数据产业博览会召开
1.工信部连发两大AI产业培育重磅文件
8月31日,工业和信息化部办公厅印发《关于开展人工智能应用服务商培育专项行动的通知》,提出围绕人工智能应用落地培育一批专业化服务商,增强人工智能技术、产品与行业需求之间的衔接能力。9月4日,工业和信息化部印发《人工智能中小企业创业支持计划(2026—2028年)》,进一步将政策支持延伸至人工智能中小企业和创业主体,围绕技术创新、成果转化、场景开放、融资对接等环节完善支持体系,降低中小企业进入人工智能产业和开展创新创业的门槛。
两项政策相继出台,反映出我国人工智能产业政策的着力点正在从模型、算力等供给侧能力建设,进一步向应用服务和创新主体培育延伸。应用服务商承担技术与场景之间的连接作用,中小企业则是垂直应用和商业模式创新的重要主体。通过同时培育“服务商”和“创业者”,有助于补齐从技术供给到场景落地之间的中间环节,推动形成大模型企业、应用服务商与中小企业协同发展的产业生态,加快人工智能从技术创新向规模化商业应用转化。
2.广州启动国家数据领域国际合作试点,探索“来数加工”和“Token出海”新模式
9月1日,国家数据领域国际合作广州试点启动会暨南沙“国际数港”建设工作推进会在广州南沙召开,广州同步推出“来数加工厂”和“Token出海”等业务模式。其中,“来数加工厂”通过在境内本地化部署人工智能大模型,为境外企业、出海企业及科研机构提供跨境大模型调用和数据处理服务,境外原始数据通过合规专线进入物理隔离算力环境完成运算,原始数据不在境内落地留存,仅回传加工或推理结果。此前南沙相关标杆项目已覆盖20余万客户,实现成本降低10%、服务响应效率提升32%。会议还推出面向AI算力企业的“词元贷”,将词元产出、算力合约价值等纳入授信依据,并发布采用“数据不动模型动”机制的医工可信科研协作平台。
此次试点表明,数据跨境流动正在从单一合规管理进一步向数字贸易、跨境AI算力服务和数据价值开发等实际业务场景延伸。“外数中算”“Token出海”等模式在保障数据安全和合规的同时,有望降低跨境数据和模型调用成本,为数据要素国际流通探索可复制的商业化路径。
3.北京发布“十五五”时期高水平开放型经济发展规划,建设国家数字贸易示范区
9月2日,北京市商务局发布《北京市“十五五”时期高水平开放型经济发展规划》,提出到2030年加速形成全球数字经济示范引领地,并将数字贸易作为高水平开放的重要增长方向。《规划》提出建设国家数字贸易示范区,统筹推进“超级节点+行业节点”算力布局,加快通信、云计算、人工智能等领域对外贸易,拓展数字人民币在数字贸易中的应用场景,并支持北京国际大数据交易所建设国家级数据交易所。同时,北京将建设跨境可信数据空间和数据跨境服务中心,持续优化数据出境负面清单,提升跨境数据流动便利化水平。
五、G20创新部长会发布共识声明
1.G20创新部长会议发布共识声明,明确人工智能与新兴技术六大合作方向
9月2日,二十国集团(G20)创新部长会议在美国北卡罗来纳州教堂山结束。会议由美国商务部和白宫科技政策办公室共同主办,与会部长发布创新部长共识声明,提出新兴技术具有释放经济繁荣、提高生产率和扩大社会机会的潜力,并围绕六个领域形成共同原则,包括支持创新的政策框架、以技术促进机会与繁荣、技术人才培养、人工智能知识产权政策、人工智能标准与标准体系、产业创新及供应链投资。同时,与会各方就《卡罗来纳新兴技术原则》达成共识,提出加强基础研究投入、完善科技成果商业化路径并推动可信技术部署。会议还形成“AI繁荣目标”和“AI繁荣契约”等成果,进一步推动G20成员国技术人才培养和私营部门合作。
2.美国能源部启动GridFM 2.0项目,以人工智能提升电网规划和扩容效率
9月1日,美国能源部电力办公室宣布投入1150万美元启动GridFM 2.0研究项目,由布鲁克海文国家实验室牵头开发面向电力系统规划的人工智能基础模型,以应对数据中心、先进制造等领域快速增长的用电需求。项目计划使电力企业能够在24小时内评估10亿种潜在电网运行场景,将规划处理能力提高超过1万倍,并使关键电网计算速度较传统方法提高超过1000倍。项目后续还将在两家电力企业开展实际部署测试,加快技术商业化应用。随着AI数据中心持续推高美国电力需求,人工智能正从电力需求增长的重要驱动因素进一步成为解决电网规划效率和基础设施扩张瓶颈的技术工具,AI与电力系统的融合正在向电网规划、投资决策和运行优化等环节延伸。
3.英国、韩国加快推动AI公共服务落地,政府采购与算力支持成为产业扶持新工具
8月31日,英国政府启动总规模1亿英镑的“主权AI研发采购计划”首批竞赛,通过政府采购方式支持本土AI企业参与公共服务数字化。首批项目主要覆盖NHS医疗服务效率提升、AI算力基础设施效率优化、国防领域AI系统集成以及AI Agent安全与韧性测试等四个方向。同日,韩国科学技术信息通信部公布“AI for All”项目入选名单,由SK Telecom、Kakao和KT牵头的三个联合体获得支持。韩国政府计划年内向三家联合体合计提供512块英伟达B200 GPU,并自2027年起对面向全民提供AI服务所需成本给予财政支持。相关服务涵盖通用AI聊天机器人、公共服务AI Agent以及健康、金融、教育、房地产等专业场景,其中公共AI Agent可协助居民查询政府福利并完成复杂申请流程
英国和韩国均开始通过政府采购、公共算力和真实公共服务场景,为本土AI企业提供规模化应用入口,AI产业扶持政策正在由研发补贴进一步转向“政府首购+算力支持+场景开放”的需求侧培育模式。
六、技术前沿:Google发布Gemini 3.8 Flash
1.Google发布Gemini 3.8 Flash系列并推出智能体视频理解能力
9月1日至2日,Google连续更新Gemini模型能力。Google首先推出Agentic Video智能体视频理解功能,使Gemini能够根据任务目标动态搜索和检查视频中的关键片段,而非按照固定帧率处理完整视频。在标准视频分析测试中,该功能最高可减少88%的Token消耗、降低66%的分析成本,同时将准确率提升最多7%,并支持亚秒级片段检索、长视频信息搜索、异常检测和动作计数等任务。9月2日,Google进一步发布Gemini 3.8 Flash和Gemini 3.8 Flash Cyber。其中,Gemini 3.8 Flash重点强化长周期软件工程、智能体任务和复杂推理能力,HLE-Verified得分达到54.9%;Gemini 3.8 Flash Cyber则面向网络安全场景,在覆盖20种编程语言的内部漏洞发现测试中成功率超过70%,并已用于Google内部代码安全工作。Gemini此次升级进一步将模型竞争由单次问答与推理能力延伸至长周期智能体、多模态信息处理和专业工具调用。
2.OpenAI将ChatGPT接入电子病历和官方医疗数据,AI医疗应用进一步深入临床工作流
9月1日,OpenAI宣布为ChatGPT for Healthcare推出新的电子健康记录(EHR)集成功能,可将Epic系统中经授权的患者信息接入ChatGPT,同时上线Healthcare Public Data插件,连接PubMed、ClinicalTrials.gov、DailyMed、CMS Coverage等9个官方医疗数据源。临床人员可通过ChatGPT汇总患者病史、实验室检查、用药变化及专科医生建议,并直接追溯至对应病历信息;在支持的部署环境中,ChatGPT还可以直接嵌入电子病历界面。
OpenAI披露,在覆盖就诊前审阅、临床时间线、用药审查和交接班摘要等27类临床任务的4,363次医生评价中,99.1%的回答被评定为安全;针对大型美国医疗数据库开展的测试中,5类已连接数据源的回答均有超过93%获得“良好”及以上准确性评价。医疗AI正在由通用医学问答进一步进入“患者病历+权威数据库+临床工作流”一体化应用阶段,真实医疗数据接入、可追溯性和合规治理正成为大模型向医疗行业深入落地的重要基础。
七、智库观点:AI主权与就业影响成为政策研究焦点
1.卡内基国际和平基金会:《Operationalizing AI Sovereignty Through Agency, Interoperability, and Openness》
9月3日,卡内基国际和平基金会发布文章指出,随着人工智能成为国家数字政策和地缘科技竞争的重要议题,各国对“AI主权”的关注快速上升,但在高度全球化的AI产业链中,追求从芯片、算力、数据到模型的全栈自主对多数国家而言并不现实。前沿AI产业具有专业化程度高、资本投入巨大和网络效应显著等特征,因此AI主权的核心不应是完全消除外部依赖,而应是在相互依赖环境中保持自主选择和战略调整能力。
文章提出,应以“自主性(Agency)、互操作性(Interoperability)和开放性(Openness)”作为AI主权的三大支柱。其中,自主性意味着国家具备理解、开发、调整和监管AI系统的能力,并能够更换供应商、参与规则制定;互操作性通过开放标准、数据可携带性和系统兼容降低单一厂商锁定风险;开放性则通过开放基础设施和技术生态降低创新门槛。文章进一步将这一框架应用于数据、模型、算力基础设施、网络连接、能源、人力资本、网络安全和AI安全等八个环节,并建议各国通过产业政策、开放标准、共享算力、区域数据空间和联合研发等方式构建“合作型数字主权”。
2.波士顿联储:《Workers’ Perspectives on Artificial Intelligence: Productivity Gains and Job-loss Fears》
9月2日,波士顿联储发布研究报告,基于纽约联储消费者预期调查2024年和2025年两轮数据,分析人工智能对美国劳动者就业预期的影响。调查显示,担忧因AI失去工作的劳动者比例从2024年底的5%上升至2025年底的略高于10%;如果进一步纳入降薪以及因无法适应AI而考虑转岗等负面结果,相关劳动者占比由约11%升至18%。与此同时,虽然只有约10%的受访者担忧自身因AI失业,但60%的劳动者预计AI会导致所在行业裁员或减少就业岗位,表明劳动者对AI冲击行业就业结构的担忧明显高于对自身职位的直接担忧。
研究进一步发现,AI带来的生产率收益与就业安全感呈现明显分化。感受到AI显著提升自身生产率的劳动者失业担忧相对较低,其担忧失业的概率约为6.1%,且14%的该类劳动者表示更可能因AI带来的生产率提升提出加薪要求;相比之下,已经使用AI替代部分工作任务、但尚未获得明显生产率提升的劳动者失业担忧最高,相关概率达到21.2%。报告认为,AI目前更可能通过替代部分任务并重新配置劳动时间来重塑工作岗位,而非短期内大规模消灭就业,但不同劳动者利用AI提升生产率的能力差异可能进一步影响就业安全感和工资议价能力。
八、风险提示
对政策理解不到位的风险;政策落实不及预期的风险;技术发展不确定性风险。


VIP复盘网