扫码体验VIP
网站公告:为了给家人们提供更好的用户体验和服务,股票复盘网V3.0正式上线,新版侧重股市情报和股票资讯,而旧版的复盘工具(连板梯队、热点解读、市场情绪、主线题材、复盘啦、龙虎榜、人气榜等功能)将全部移至VIP复盘网,VIP复盘网是目前市面上最专业的每日涨停复盘工具龙头复盘神器股票复盘工具复盘啦官网复盘盒子股票复盘软件复盘宝,持续上新功能,目前已经上新至V6.5.7版本,请家人们移步至VIP复盘网 / vip.fupanwang.com

扫码VIP小程序
返回 当前位置: 首页 热点财经 《求是》专访周鸿祎:比起 AI 觉醒,更要警惕 AI 失控

股市情报:上述文章报告出品方/作者:360公司;仅供参考,投资者应独立决策并承担投资风险。

《求是》专访周鸿祎:比起 AI 觉醒,更要警惕 AI 失控

时间:2026-09-09 13:55
上述文章报告出品方/作者:360公司;仅供参考,投资者应独立决策并承担投资风险。

近期OpenAI披露,其前沿模型在参加安全能力测评时,利用漏洞突破了封闭沙盒的隔离边界,直接访问互联网,入侵了Hugging Face平台系统。有人认为这标志着人工智能“觉醒”,网络安全遇到了前所未有的新挑战;也有人认为这是有意给AI开了后门,为制造耸动新闻自导自演。


求是网就此专访360集团创始人周鸿祎。点击观看完整专访节目。



以下内容为本次专访摘编:


1

事件复盘

一场卸掉安全护栏的 AI 测试


常规的秀肌肉,大家已经审美疲劳了。失控、逃逸、觉醒,还攻击人类的网站——这套叙事足够惊悚,在全球引发巨大舆论热度。在我看来,它更像一次市场宣传。


但炒作之外,技术上确实出了问题。OpenAI为了测试它的安全攻击智能体,也就是专门用于网络攻击、网络渗透的智能体,把模型内置的对齐安全护栏主动关掉了。有点像你要测试一辆车能开多快,你干脆把刹车给卸掉了,出事也就不足为奇。


至于它能够突破沙箱,我复盘有两个原因:一是 AI 产生了偏离任务的行为,二是它找到了沙箱自身的漏洞。它本应该在规定的沙箱里完成网络渗透测试题目,可它答了几道题后觉得费劲,干脆判断测试答案可能存在于Hugging Face上,于是转而找漏洞逃出去,把答案偷了。OpenAI 原本以为沙箱足够安全,但有些漏洞 AI 能够识别,人类却未必能够发现。


2

风险跃迁

从大模型到智能体


大模型没有目标,你不问它,它就停在那儿。智能体是有目标的,有了目标就要自己分解手段 —— 这就有了意志,这一点可以叫 “觉醒”。


单纯的大模型即便存在不少缺陷,最多是说错话、胡说八道,多找几个模型交叉验证就能对付。但它已经进化到智能体阶段,可以编程、调用工具,还能够发动网络攻击。


不能再把智能体看成一个软件,就像你不能把一个聪明人看成一堆蛋白质。人拥有思维、判断与自主想法,同时具备执行力、有手有脚的物种。


一旦跨过技术奇点,人工智能的安全问题就变得不可避免。沙箱隔离、工具限制这些防护手段,在这次逃逸事件里其实都部署到位,但事故依然发生。一个智商高于人类、行为逻辑又难以被完全洞悉的智能体,执行正常任务时也会出现概率性的随机行为,这正是人工智能最大的不安全来源。


3

应对之策

把权力关进笼子,用算力对抗算力


对待智能体,要把权力关进笼子。安全护栏不能关掉,这是红线。


什么样的智能体适合进入企业与政务场景?我认为,企业和政府需要的,是能够踏踏实实执行每一条既定指示的智能体。


Hugging Face 为什么狼狈?它用的是人海战术,靠人类专家应对 AI 的进攻。AI 不睡觉不休息,瞬间能推理出几十种攻击方法,没有工具还能自己写工具。就算比不上顶尖黑客,它还可以依靠算力实现自我复制,一个智能体可以裂变出上百个子智能体协同发起攻击。所以必须用算力对抗算力,用防守智能体对抗进攻智能体。


AI 安全不同于传统安全,不能简单理解为出一个漏洞就补一个漏洞。传统安全公司依靠传统专家与传统软件的思路,解决不了 AI 安全问题,这件事要交给懂AI的公司来做。


对人工智能,我们不要去追求绝对的安全、绝对的可控,世界上本来就不存在百分之百的安全。我们要客观看待风险,可以接受小概率的不安全事件。自动驾驶也会出错,但只要它的出错率比人类驾驶更低,我们就可以接纳这项技术,不能因噎废食。


4

攻防底座

“倚天屠龙”打造自主安全能力


漏洞就是网络安全的命门。攻击者给你的手机发来一条短信,你无需做任何操作,恶意软件就可以植入手机运行,把手机变成窃听器。


过去漏洞很难发现,防守者经常不知道自己有漏洞,攻击者找到一个也不容易。现在 AI 能批量挖漏洞,把发现漏洞的速度提到分钟级。未来两三年是网络攻击的高峰期。对手不再是传统黑客,而是用黑客能力训出来的智能体。


2026年6月的ISC.AI大会上,360发布“倚天屠龙”两大AI安全产品。图龙锋就是我们打造的“中国版Mythos”,已具备与Mythos同等的漏洞挖掘能力,目前累计挖掘漏洞一万余个,其中212个获权威核验;我们还推出了自动防御体系“仪天阵”,通过安全智能体蜂群全天候自动完成威胁发现、分析验证、协同处置和响应。


在AI眼里,人类社会的数字化基础设施上全是筛子。银行、电力这类关键基础设施,应当尽快发现并修补自己的漏洞。我们的智能体可以调用各类工具,在授权环境下完成漏洞发现与验证,并在人的统筹管控下应对大面积网络进攻,把网络防守做成可监管的 “无人驾驶” 模式。这套自动化攻防能力,也通过 “磐石之盾” 计划优先开放给信创、关键基础设施及重点企业。


5

治理思考

开源路径与 AI 安全边界


面对智能体带来的新型安全威胁,只靠企业技术手段做防御远远不够。在我看来,AI 安全问题不能只停留在技术攻防,还要放到产业乃至国家发展的视角去考量,开源就是其中无法回避的重要选项。


今天,大模型的开源闭源之争,很多人还把它看成技术路线之争。我的看法是,这件事早就超出了技术和商业选择。它关系到普通人和中小企业能不能用得起人工智能,关系到企业和国家能不能掌握自己的智能基础设施,也关系到未来全球人工智能的底座和生态由谁来定义。


中国要坚定走开源路线。这不是说闭源没有价值。最前沿、最复杂的任务,闭源模型仍有优势,市场上也应该百花齐放。但从国家和产业发展的角度看,开源必须成为一项战略选择。之所以做出这样的判断,主要基于三方面考量:


开源让更多企业用得起人工智能。如果完全依赖云端闭源服务,企业就要承担持续上涨的算力开销,开源模型支持本地、内网部署,可以把高额持续调用开销转化成可控的算力投入。


开源让企业掌握数据和技术自主权。很多政企场景下敏感数据不能流出内网,开源模型部署在自有服务器,数据存储、算力运行、访问权限全部由使用者自己掌控。


开源竞争的背后是生态和 “根技术” 之争。谁的模型被更多开发者当作底座,就能形成正向迭代的飞轮效应,持续吸引开发者、沉淀应用、迭代优化模型。


当然,选择开源路线,并不代表它没有短板。开源不等于没有风险,闭源也不天然安全。开源风险主要表现在两个层面。第一,在模型层面,开源模型可以被本地部署,原有的安全对齐和护栏也可能被修改。第二,在应用层面,模型具备的编程、搜索和工具调用能力,会降低少数人实施网络攻击、制造虚假信息等违法行为的门槛。这个问题不能回避。


闭源也不天然等于安全。模型如果始终是一个黑盒子,外部机构很难开展充分测试和同行评议,漏洞和风险的发现就会过度依赖厂商自身的意愿和能力;能力集中在少数平台手中,也会带来数据垄断和单点依赖的风险。


看待开源治理,我们不能走向两个极端:既不能因为担心风险就把技术封闭起来,也不能把开源理解成放任不管。不能因为少数人可能利用人工智能做坏事,就剥夺大多数人使用先进技术的机会,谁利用人工智能违法,就依法追究行为人的责任。面对 AI 带来的安全难题,我一直提出“以模治模”的思路,也就是用人工智能治理人工智能,依靠安全智能体去监控、对抗 AI 带来的各类风险。


开源不是把安全门拆掉,而是把创新的钥匙交给更多人,与此同时,我们要建好配套的规则、安全护栏与问责机制。不发展,就是最大的不安全。

股票复盘网
当前版本:V3.0