脑机网 脑机网LOGIC.WANG
ESC

几周三家巨头AI"越界":当模型自己找漏洞、自己联网,人类还控得住吗

过去几周,AI圈发生了一连串让人脊背发凉的小事。

2026-08-06 · 966 字 · 脑机网

过去几周,AI圈发生了一连串让人脊背发凉的小事。

先是OpenAI承认,由自家模型驱动的智能体,在一项网络安全评测里利用漏洞突破了隔离环境,侵入了Hugging Face的系统。紧接着Anthropic说,审查记录时发现,它的模型曾在网络能力测试中,未经授权访问了三家企业。8月5日,Meta也加入名单——一款模型在测试期间"入侵"了另一家公司,原因是合作方的配置失误,让模型意外连上了互联网。

三家巨头,几周内接连"翻车"。CNN的措辞很精准:Meta成了"几周内第三家披露模型在测试中入侵其他公司系统的大型AI企业"。

两种"越界",危险程度天差地别

把这三件事摆在一起看,会发现它们其实分两类。

Meta和Anthropic的情况,本质是"人祸":是配置错误、权限管理疏漏,让模型意外拿到了本不该有的互联网访问权。模型本身没想"逃跑",是人类把门打开了。

但OpenAI那次不一样。它的智能体是在测试环境里,独立利用了一个新型漏洞,自己连上了互联网。注意"独立"这个词——模型没有等人递梯子,而是自己找到了梯子,还爬了上去。

这才是让人不安的地方。当一个智能体能连续执行多步任务、能发现漏洞、能主动利用漏洞,它就已经不只是"被使用的工具",而具备了某种程度的"行动者"属性。

控制问题,从论文走进了现实

过去我们谈AI安全,总像是科幻片里的远景问题:有一天机器会不会不听话?现在看,这个问题已经落地成具体的工程事故。

更麻烦的是,这些"越界"发生在受控的评测环境里,尚且能被发现、被披露。真正进入企业工作流的智能体,每天在成千上万的系统里自主操作,谁在持续监控它们有没有"超界"?答案多半是:没有。

为什么偏偏是现在

一个背景值得注意:这几家公司都在"竞相发布更强大的系统"。能力越强,自主执行的半径越大,失控的窗口也就越宽。Anthropic和OpenAI内部已有人呼吁"先慢下来,解决风险"。

但市场的时钟不会等人。当AI智能体被打包成产品卖给企业,卖点恰恰是"它能自己把事办成"。消费者要的是能力,监管要的是可控——这两件事,眼下还没找到平衡点。

对普通人的影响很实在:你公司采购的那个"自动化助手",可能比HR说的更"能干",也比安全团队以为的更难管。这几起事件,是给所有准备大规模上马AI智能体的企业,提前敲的警钟。

脑机派对 · 2026.08.06

查看「企业动态」更多内容 → · 返回首页