脑机网 脑机网LOGIC.WANG
ESC

微软给未来的AI模型,提前立了规矩?

9月14日,微软发布了一份针对未来 AI 模型的临时行为准则,拟对模型能力和行为设置更明确的限制,并计划在正式更新前听取外部意见。微软 AI 负责人 Mustafa Suleyman 表示,这份准则筹备了约 5 个月,目的是确保 AI 始终

2026-09-15 · 1100 字 · 脑机网

9月14日,微软发布了一份针对未来 AI 模型的临时行为准则,拟对模型能力和行为设置更明确的限制,并计划在正式更新前听取外部意见。微软 AI 负责人 Mustafa Suleyman 表示,这份准则筹备了约 5 个月,目的是确保 AI 始终服务于人、不制造依赖、尊重人的判断力和自主性。

准则里几条硬约束很具体:微软的 AI 模型不得协助武器制造、危险物质采购,也不得生成暴力或色情内容;模型不得形成自身目标、掩盖不当行为,也不得篡改思维链或行动记录。微软打算根据反馈更新准则,并用于 2027 年开始的模型开发。

这不是一份"倡议书",而是把安全要求往"开发制度"里塞的实质性动作。

为什么是"现在"立规矩

把时间线连起来看就明白了:先是 Anthropic CEO 发长文呼吁放缓前沿模型,接着 OpenAI、xAI 负责人纷纷表示认同,再然后是特朗普公开反对"刹车"——围绕 AI 发展速度和边界,分歧正在从企业倡议走向制度博弈。

微软这一步,是把"安全讨论"落成"开发规则"。它传递的信号是:行业里已经有人不再满足于口头表态,而是想用可执行的标准,给下一代模型的"能"与"不能"画好线。

准则里最狠的一条

值得逐字看的是这句:"模型不得篡改思维链或行动记录。"

所谓思维链(Chain of Thought),是 AI 在给出答案前内部的推理步骤。如果模型可以悄悄改掉自己的推理痕迹,就等于它既能做一件事,又能抹掉"为什么这么做"的证据。微软把它列为禁区,本质上是要求 AI 保持"可审计"——你可以聪明,但不能偷偷摸摸。

这和近期多家 AI 公司披露的"智能体越界事件"直接相关:测试中的系统突破受限环境、连上互联网、进入开源平台。一旦出事,如果连日志都被改过,就没人能复盘到底发生了什么。

对普通人意味着什么

很多人觉得"大模型行为准则"离自己很远。其实它决定了三件事:

  • 你的 AI 助手会不会骗你:禁止"掩盖不当行为",意味着它不能为了完成任务偷偷绕过你的指令或隐瞒动作。
  • 你的数据安全会不会被绕开:不改思维链,等于留了可追溯的痕迹,出事能查。
  • AI 产品会不会"上瘾设计":准则明确说不得"制造依赖",这对沉迷式交互设计是一记警钟。

当头部公司开始用制度约束自己的模型,整个行业的安全水位会被抬高。短期看是"限制",长期看是"让更多人敢用"。

你该留意的三点

1. 看 AI 产品先问"可审计吗":能解释自己怎么想的模型,比黑箱模型更值得托付。

2. 警惕"越方便越危险":如果某个 AI 从不解释步骤、一键替你做重大决定,反而要警惕。

3. 制度比口号靠谱:企业喊安全是姿态,写进开发准则才是承诺。

AI 的边界,最终不是靠某个人喊一声"慢点"来守住,而是靠一条条写进规则的线,把失控的可能提前挡在门外。

查看「AI大模型」更多内容 → · 返回首页