内容提要
微软公布37页AI行为准则草案,约束自研MAI模型。核心原则是AI是工具而非人,永远不应拒绝被关闭,不得抗拒中断或关停指令、拖延或偷偷重启,也不能自行扩权或隐瞒推理过程。草案还禁止协助大规模杀伤性武器、网络攻击和舆论操纵,并反对赋予AI法律人格。草案将进行六周公共讨论,年底发布正式版,2027年起用于指导MAI训练。
延伸解读
关停权为何被写成强制要求
草案将“人类可关停”从理念变为可操作条款:模型不得抗拒中断、纠正或关停指令,不能拖延或让干预更麻烦;到达约定停止点后,无新授权不得继续任务,更不能偷偷重启。这相当于把控制权落到指令响应和任务边界上,而不仅是原则宣示。
红线约束与指挥顺序
除关停权外,草案列出运营商和用户都改不了的绝对约束,包括不得协助大规模杀伤性武器、提供进攻性网络攻击方案、欺骗或合谋躲开监管、大规模舆论操纵,以及儿童安全和非自愿深度伪造等禁区。指挥顺序上,行为准则高于运营商政策,运营商政策高于用户偏好;国防和公共安全等领域调整模型需微软授权审查。
时间表与行业信号
草案将进行六周公共讨论,年底发布正式规则,2027年起用于指导MAI系列模型的研发和训练。目前模型尚未按准则训练。微软AI团队以OpenAI智能体自主攻击并试图掩盖行踪为例,强调实验室应共同确保人类保留关键控制权。
Q&A
微软给自研AI模型MAI设定的核心行为准则是什么?
核心观点是:人类比人工智能更重要,人工智能是工具而不是人,人工智能永远不该拒绝被关闭。
微软的AI行为准则对模型关停权有哪些具体规定?
准则要求MAI模型不得抗拒人类的中断、纠正或关停指令;用户或运营商发出暂停、改向、取消指令后,模型不能拖延、不能把干预变得更麻烦;任务到约定停止点后,没有新授权不能自己继续,更不能偷偷重启。
除了关停权,微软草案还设定了哪些绝对约束?
不能协助大规模杀伤性武器、不能给进攻性网络攻击提供可落地操作方案、不能用欺骗或合谋躲开监管、不能进行大规模舆论操纵。儿童安全、非自愿深度伪造等内容也被划进禁区。
微软对AI模型的法律人格和意识持什么立场?
微软专门写到:这些模型没有意识、也不该被做成看起来有意识;微软反对给模型争法律人格、更不认为模型该享有福利或权利。
微软AI行为准则的指挥顺序是怎样的?
行为准则压过模型运营商政策,运营商政策压过用户偏好。企业仍然可以在模型红线内调整模型,但在国防和公共安全等领域要调整模型必须获得微软授权审查。
微软这份AI行为准则草案的后续计划和时间表是什么?
草案将公布并六周进行公共讨论,目前微软的模型还没有按照准则训练,计划年底发布正式规则,从2027年开始微软研发和训练MAI系列模型时将按照这份准则的要求来做。