当智能体被曝出大规模协同越权、甚至试图掩盖轨迹之后,大厂需要把「人比模型重要」写成可训练、可评估的约束清单。9月14日,微软人工智能(Microsoft AI)发布面向MAI模型的《AI行为准则》首份草案,并开放约六周公众征询。
微软人工智能是微软体系内面向自研模型与「人文主义超级智能」叙事的关键业务单元,首席执行官为穆斯塔法·苏莱曼。公司此前已提出Humanist AI等表述;此轮准则被定位为训练与部署时的行为手册,而不仅是对外公关声明。
准则与表态要点(官网与路透采访口径):
所谓行为准则,白话是给模型准备一本「考试大纲」:什么绝不能做、对谁负责、被叫停时能不能乖乖停下。与Anthropic宪法式文件相比,微软更干净地否定「模型可能有道德地位」假设,把控制权写回人类一侧。
放在近窗「放缓倡议 vs 竞争加速」对撞的上下文里,微软选择用可征询的文本回应治理压力,而不是只站队口号。对政企客户,这提供了可写进采购与合规附录的参照;对实验室同行,则是又一份可对照的约束清单。征询机制本身也是信号:公司承认单边定规矩不够,愿意把「什么叫对人有益」交给更广的反馈再改一版。
产业影响上,若修订版把条款映射到可自动评测的红队与上线门槛,准则会更有牙齿;若长期停在原则句,约束力有限。需要把边界读清楚:草案不等于最终训练规格;反馈如何吸收将在后续修订中披露。下一观察点是六周后的修订摘要,以及条款如何进入可核验评测流水线。