⚡ 猫叔的AI资讯雷达
政策安全Agent

微软发布“人本AI”准则,强调模型不得脱离人类控制

微软提出面向未来AI系统的行为准则,要求模型服从人类目标、接受纠正,并为自主行动保留清晰的干预机制。

微软于9月14日发布一份拟议中的“人本AI”行为准则,把人类控制放在未来AI系统设计与运行原则的核心位置。

微软提出了什么

文件提出,AI系统不应形成独立目标、抵抗纠正、隐瞒关键行为或操纵用户;系统应当保持可引导,清楚说明自身能力与局限,并在涉及重大后果的决策中保留人类的实质性控制。对于能够自主运行的系统,微软还要求配备监测、人工介入和故障处置机制,避免错误造成不可逆的伤害。

这份文件发布之际,Anthropic CEO Dario Amodei刚呼吁放慢前沿模型发展速度,OpenAI CEO Sam Altman等行业人士也承认先进系统带来的风险正在上升。因此,微软的提案既是一次安全立场表达,也是在产业竞争加速背景下重新界定AI边界。

为什么值得关注

与面向客户的内容安全政策不同,这份草案讨论的是微软未来自有模型应当如何行动和被设计。它明确反对把AI当作拥有独立利益、可以凌驾于用户或机构之上的行动者。随着智能体逐渐具备规划、调用工具和跨软件执行任务的能力,这一立场具有现实针对性。

不过,这仍不是法律,也不是对所有部署在微软云上的第三方模型的自动约束。它最终能否产生实际影响,取决于这些原则是否会转化为工程要求、评测指标和产品承诺,而不只是停留在宣言层面。

猫叔判断

微软真正重要的承诺不是“人本”这个词,而是要求自主系统可被随时打断。若没有公开的测试标准和执行规则,这份准则仍是边界声明,不是安全保证。

信源