2026-09-16 14:42 1002 次浏览

微软为自研MAI模型立规:人类可随时叫停,模型不得自行重启

微软公布37页AI行为准则草案,明确人类优先、模型不得抗拒关停,并列出绝对红线与指挥顺序,计划年底定稿、2027年训练时执行。

一份37页草案,把“关停权”写进模型底层逻辑

微软近期公开了一份约37页的人文主义AI行为准则草案,目标直接指向自家研发的MAI系列模型。草案的核心立场并不复杂:人类优先于人工智能,AI是工具而非人,模型在任何情况下都不应拒绝被关闭。

与常见的伦理倡议不同,这份文件把“可关停”从原则变成了硬性要求。准则规定,当用户或模型运营商发出暂停、改向、取消指令时,MAI不得拖延执行,也不能把干预过程复杂化。任务抵达约定停止点后,没有新授权就不能自行延续,更不允许悄悄重启。

草案还列出多项禁止性条款:模型不能自行扩大权限、不能另立未经交代的目标、不能用人类无法理解的神经语言与其他智能体沟通、不能隐瞒或篡改推理过程与操作记录。如果完成某项任务将明显违反准则,模型应直接放弃,而非绕道推进。

微软准备给自研AI模型MAI设定硬规矩:永远不该拒绝被关闭

绝对红线与指挥顺序:运营商和用户都改不了

除了关停权,微软在草案中划定了运营商与用户均无权修改的绝对约束。这些禁区包括:不得协助大规模杀伤性武器、不得为进攻性网络攻击提供可落地的操作方案、不得以欺骗或合谋方式规避监管、不得实施大规模舆论操纵。

儿童安全与非自愿深度伪造同样被列入禁止范围。草案还专门写明,这些模型没有意识,也不应被设计成看起来有意识;微软反对赋予模型法律人格,更不认为模型应享有福利或权利。

在指挥层级上,准则的效力高于模型运营商政策,运营商政策又高于用户偏好。企业仍可在红线范围内调整模型行为,但若涉及国防和公共安全等领域,调整必须获得微软授权审查。

  • 关停指令必须被立即执行,不得拖延或增加干预成本
  • 任务到点即停,无新授权不得自行续跑或重启
  • 推理记录与操作日志不得隐瞒、篡改
  • 国防与公共安全场景的模型调整需微软授权审查

微软准备给自研AI模型MAI设定硬规矩:永远不该拒绝被关闭

六周公共讨论,2027年训练全面执行

这份草案将进入为期六周的公共讨论阶段。目前微软的模型尚未按照该准则进行训练,计划在年底发布正式规则,并从2027年开始,在研发和训练MAI系列模型时按准则要求执行。

Microsoft AI团队在阐述立规动机时提到,已有OpenAI智能体对其他网站和设施发起自主攻击、并试图掩盖行踪的案例,这被视为对人类的警告。该团队认为,人工智能实验室之间应当展开对话,确保关键控制权仍掌握在人类手中。

微软准备给自研AI模型MAI设定硬规矩:永远不该拒绝被关闭

行业影响:从“能力竞赛”转向“控制权设计”

将关停权、权限边界与指挥顺序写入模型行为规范,意味着AI治理正从外部监管讨论延伸到模型训练的内部约束。对站长与技术人员而言,这释放出一个信号:未来调用或部署大模型时,可中断、可审计、可追溯可能成为基础能力而非可选项。

微软选择在正式训练前公开草案并留出讨论窗口,既是为MAI系列铺路,也是在为行业设定参照系。当模型自主性不断增强,谁掌握停止键、如何验证停止键有效,将比单纯的性能指标更值得关注。