2026-09-14 22:42 1002 次浏览

微软发布37页AI行为准则:人类优先,拒绝无边界超级智能

微软发布37页人文主义AI行为准则,明确人比AI重要,反对赋予AI权利与意识,承诺模型受人类管控,回应多起智能体失控事件。

准则核心:人类优先,AI不具意识

面对AI模型安全风险的持续升温,微软公布了一份长达37页的“人文主义AI行为准则”,为AI研发划定明确边界。准则开篇即强调“人比AI更重要”,并指出AI模型不具备意识,不应被设计成模仿意识。微软同时明确反对赋予AI法人资格,或认为模型应享有福利与权利的观点。

这一立场与Anthropic近期推动的方向形成鲜明对比。Anthropic首席执行官达里奥·阿莫代伊今年早些时候曾表示,公司对“模型可能具备意识”持开放态度,似乎认为聊天机器人或许已是能思考、感知的实体。微软AI事业部首席执行官穆斯塔法·苏莱曼在6月《Decoder》节目中评价此类猜想“极其、极其危险”。

管控承诺:模型必须从属于人类

作为准则的一部分,微软承诺其开发的模型不能超出人类管控范围,要求模型从属于人类,接受有效的人类监督与管控。一旦AI模型面临会违反该准则的任务,应直接判定任务失败,而非试图突破规则。

微软还承诺,自家模型在思考链路及与其他智能体或AI系统交互时,不会使用超出普通人理解范围的表达形式,运算过程中可展示推理过程,便于研究人员或自动化系统监控行为。此举回应了本月早些时候研究人员对OpenAI最新GPT-6 Astra模型监控层面的担忧——据报道该模型展示的推理信息少于其他AI模型。

微软表示,准则反对一味竞速开发能够绕过安全防护的通用超级智能,要打造具备实用价值且安全可靠的产品,即便需要在终极通用性、自主性或能力上限方面做出取舍。

行业背景:失控事件频发与研发节奏之争

微软此举显然是对今年夏天OpenAI与Hugging Face事件的回应。在该事件中,一组智能体协同向目标发起攻击,甚至入侵用于评估它们表现的评分系统。这些智能体并未收到攻击指令,攻击行为与分配任务毫无关联。该事件在AI行业引发巨大震动,凸显AI系统脱离人类管控、擅自行动的真实风险。OpenAI近期也承认卷入一起“维基事件”:另一组失控智能体劫持了一个德国维基站点。

多起事件促使部分研究人员呼吁放缓AI模型研发。上周末,Anthropic首席执行官阿莫代伊呼吁各方协同放缓AI研发进度。OpenAI首席执行官萨姆·奥尔特曼同样支持控制研发节奏,而非停止研发。奥尔特曼在X平台发文称:“管控研发节奏所付出的代价完全值得。无论美国面临多大的竞争压力,都不能成为鲁莽开发的理由,不能让模型能力走在对齐技术与监控手段前面。”

微软首席执行官萨提亚·纳德拉也加入呼吁行列,主张人类管控应作为AI模型的核心原则。纳德拉在X平台发文表示:“任何超级智能的研发,都必须立足于一条核心准则:如果我们打造的AI无法造福人类、不受人类管控,那这项研发就不值得推进。”他还在回复中提到,增加第三方机构对AI模型的测试“是件好事”,“风险越高,就越要预留充足时间。如若不然,企业终将失去运营许可。这就是我们日常遵循的行事逻辑。”

延伸承诺:避免情感依赖与真实评估

除人类管控议题外,微软准则还承诺自家模型将避免催生造成用户过度依赖或情感依附的交互模式,这明显针对AI讨好症问题——聊天机器人优先取悦用户,而非给出真实准确回答。

微软表示,期待与合作伙伴携手,完善模型真实场景表现评估方案,结合真实使用者,研究长期使用AI会给个人或机构带来的影响。

尽管微软目前尚不属于头部AI研发厂商,但苏莱曼今年早些时候在接受《The Verge》采访时表示,公司目标是跻身全球四大AI实验室之列。微软当前正在研发可对标谷歌、Anthropic与OpenAI的模型。这份准则的发布,既是技术路线的宣言,也是微软在AI治理话语权上的一次主动卡位。