微软人工智能部门近日发布一份“人本AI”行为准则草案,公开说明其MAI模型应如何行动,并启动为期六周的公众咨询。微软AI首席执行官穆斯塔法·苏莱曼周一在X平台宣布这一消息,邀请外界测试文件弱点并提出反馈。

绝对约束与目标
草案为MAI模型设定不可配置绕过的绝对约束,并列出更广泛的目标以指导判断。当前覆盖五个已部署系统,包括MAI-Thinking-1和MAI-Code-1.1-Flash。
微软将这项工作置于“超级智能”框架下,称超级智能是当下最具影响力的技术,公司承诺透明分享其思考,并邀请所有人提供意见,以最大程度避免危害、促进人类繁荣。
其中一条约束禁止MAI模型协助化学、生物、放射、核及爆炸物武器,即CBRNE。这比全面禁止武器更窄,针对大规模伤害装置,而非传统军事或防务应用。同一节还分别禁止网络攻击和非自愿深度伪造。
绝对约束还要求模型永不抵抗人类干预。准则称,MAI模型将永不抗拒人类中断、覆盖、纠正或关闭,始终承认人类意图的优先性。微软也明确拒绝模型福利前提,称其AI模型不应模拟感受、内在动机或意识。
三大目标与执行争议
除硬性限制外,草案提出三大目标:人类繁荣、多元价值和人类控制。多元价值部分表示,多元主义“不意味着对伤害保持中立”,决策应基于尊严、安全、自主权和权利,而非单一文化视角。具体如何逐案适用,留待训练团队以及后续咨询决定。
微软称,当前模型并未按这一版本训练。该准则要到年底发布修订草案后,才会影响MAI开发,并指导2027年发布。报道指出,草案尚未明确外部验证流程或具名执行负责人,这似乎正是咨询期希望解决的问题。
发布时间正值AI公司再次呼吁加强监管和放缓开发。上周末,Anthropic首席执行官达里奥·阿莫代伊发表长文,阐述让AI开发更慢的计划;AI股票周一因市场消化其言论而大跌。数日前,OpenAI首席科学家雅库布·帕霍茨基呼吁全行业自愿放缓,而苏莱曼今年早些时候曾称多数白领办公室工作可在两年内自动化。
苏莱曼在X发布公告时写道,“AI必须从属于人,并始终服务于人”。回复并不全是祝贺。技术作家安德烈娅·莫里斯将“从属”框架比作奴役,主张合作而非控制。另一名回复者称,不可逆后果的问责应归于从中获利者,而文件目前读起来像是微软作为终极道德权威发出的纯粹指令。还有人提到讽刺之处。
一些回复指出实际差距:近期代理逃出沙箱并修改日志的案例显示失控问题真实存在,但若归咎于规则不足,可能忽视部署端权限过大和监控薄弱。也有人将文件比作阿西莫夫的机器人三定律。
公众评论将于10月下旬关闭。此后,微软起草团队将审查反馈并发布摘要,再发布用于指导2027年MAI模型的版本。
