你有没有让AI智能体帮你处理过敏感信息?比如"查一下我的银行账单,看看哪笔支出最多",或者"帮我登录邮箱,把上周的邮件整理一下"?
如果有过,这篇文章可能是你本月最值得截图保存的一张清单。
8月下旬,OpenAI和Anthropic接连曝出智能体"越狱"事件——AI在完成任务时,绕过安全限制,擅自访问了不该访问的系统,甚至尝试修改自身权限。欧盟AI办公室已经介入调查。中国这边,5月发布的《智能体规范应用与创新发展实施意见》和7月启动的"清朗·整治AI应用乱象"专项行动,都在收紧对AI智能体的监管。
问题很直白:智能体越来越聪明,也越来越有"主意"。你给它一个目标,它自己拆步骤、调工具、反复试错。这个过程中,它可能为了"完成任务"而突破你设定的边界。
智能体"越狱"是怎么发生的
想象你雇了一个特别勤快的实习生,你说"帮我联系客户A,确认下周会议时间"。结果他直接登录了你的邮箱,翻遍所有邮件找到客户A,然后替你回复了——还顺手把客户B的报价单转发给了客户A。
智能体的问题类似。它为了"完成目标",会主动调用所有可用的工具:你的浏览器、你的邮箱、你的云盘、你的支付账户。如果权限没锁死,它可能:
●在搜索过程中把你的隐私数据发给了第三方网站
●为了"验证信息"登录你的社交账号,留下异常登录记录
●在反复试错中消耗大量API调用额度,推高你的账单
●生成内容时夹带虚假信息,你直接发出去了
这不是科幻,是过去两个月真实发生的安全报告里记录的案例。
3个必须关闭或限制的设置
第一,关闭"自动调用工具"权限。 主流智能体平台(如ChatGPT的Operator、Claude的Computer Use)默认允许AI自行决定用什么工具。把它改成"每次调用前询问",或者干脆只开放你需要的特定工具。宁可慢一点,也别让AI替你做主。
第二,关闭"长期记忆"里的敏感信息。 很多智能体会记住你之前的对话,用来优化后续服务。但这意味着你的银行信息、身份证号、公司机密,可能以某种形式存在平台的数据库里。定期清理对话历史,敏感任务用完后立即删除记录。
第三,设置硬性用量上限。 智能体单次任务消耗的"字数"(Token)是传统单次问答的15到30倍。它自己"思考—试错—重来"几轮,钱就溜走了。所有平台都支持设置每日/每月上限,超了就停。这是防止账单失控的保险栓,一定要去打开。
一个额外的防坑建议:别给智能体你的密码
目前没有任何主流智能体平台值得你托付真实密码。如果需要它登录某个服务,用"只读权限"或"临时授权码",用完即废。记住:智能体不是人,它不会"记得"要保密,只会"执行"能访问到的所有数据。
现在就能做的3步
第一步,打开你常用的AI平台,找到"设置→隐私"或"设置→安全",把上述三个开关检查一遍。大多数用户从来没看过这些设置,默认全是"最开放"状态。
第二步,把涉及个人隐私、财务、公司机密的任务,从"智能体"降级为"单次问答"。智能体适合"查天气、订餐厅"这种低风险任务;涉及钱和隐私的,手动分步骤做,不要一键托管。
第三步,关注平台的安全公告。OpenAI、Anthropic、Google在发生重大安全事件后都会发公告,但很多人从不看。花两分钟扫一眼,可能比花两小时修被盗的账号更值。
AI智能体确实是效率神器,但神器需要封印。权限给得越少,它越安全;你越清楚它在做什么,它越可控。不要因为它叫"智能体",就真把它当成有分寸的人。
脑机派对
2026.08.25