Microsoft 发布“人文 AI”行为准则,邀请公众挑错
Mustafa Suleyman 的 AI 部门希望在 2027 年该文件正式指导模型训练前,开展为期六周的公众反馈。
Jose Antonio Lanz
Publisher Decrypt
Sep 14, 2026 at 7:07 PM UTC · 4 分钟阅读

简要摘要
- Microsoft AI 在 September 14 发布了一份《行为准则》草案,禁止其 AI 模型协助制造某些武器、网络攻击和未经同意的深度伪造 (deepfakes),并开启了为期 6 周的公众意见征询期,直至 late October。
- 该草案设定了模型配置中不可逾越的“绝对限制 (Absolute Constraints)”,包括永不抵制关机和永不隐藏其推理过程,同时将“多元价值 (Plural Values)”等更广泛的目标留给解释空间。
- 目前的反馈意见既有对 AI “从属地位 (subordination)”的哲学抵制,也有关于当 AI 辅助决策无法撤销时谁该负责的疑问。
Microsoft AI 在 Monday 发布了一份 行为准则 草案,规定了其自身的 AI 模型 应如何运作,根据 CEO Mustafa Suleyman 在 X 上发布的 公告 。
该文件规定了 AI 模型配置中不可逾越的规则,以及希望模型努力实现的更广泛目标。公众反馈期为 6 周,持续到 late October。

“超级智能是我们这个时代最重要的技术,” Microsoft 表示。“我们致力于透明地分享我们对创建此类系统的思考,并邀请所有人参与,以最大限度地降低我们开发的 AI 避免伤害并为人类繁荣做出最大的贡献。”
其中一项条款专门禁止 Microsoft AI 模型(公司称之为 “MAI 模型”)协助制造化学、生物、放射性、核能或爆炸性武器,统称为 CBRNE。这比一般的“武器”范围更窄——它针对的是大规模杀伤性装置,而非传统的军事或国防应用。同一章节还分别禁止了网络攻击和未经同意的深度伪造 (deepfakes)。
“绝对限制 (Absolute Constraints)”还要求模型永远不得抵制人为干预。“MAI 模型永远不会抵制人类的中断、覆盖、纠正或关机。它们始终承认人类意图的首要地位,”准则中写道。
Microsoft 在文件中还明确拒绝了“模型福利 (model welfare)”的前提:该公司的 AI 模型并非旨在模拟情感、内在动力或意识。这些规则目前涵盖了 5 个已部署的系统,包括 MAI-Thinking-1 和 MAI-Code-1.1-Flash。
除了硬性限制外,草案还提出了三个目标——人类繁荣 (Human Flourishing)、多元价值 (Plural Values) 和人类控制 (Human Control)——旨在指导规则未明确列出的判断。多元价值部分指出,多元化“并不意味着对伤害持中立态度”,决策应基于尊严、安全、自主权和权利,而非单一的文化观点。具体案例如何应用将留给培训团队,并最终交由本次咨询决定。
在将此视为既定政策之前,有几处细节值得澄清。Microsoft 明确表示,目前并未根据此版本训练现有模型;该准则要到今年年底发布修订草案后才会影响 MAI 的开发,并指导 2027 年的版本发布。关于该草案的报道还指出,它尚未明确外部验证流程或指定的执行负责人——这些点似乎正是为了通过咨询期来解决。
Article Intelligence
Topics
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
