摘要:微软公布 Humanist AI Code of Conduct 首份草案,禁止模型协助武器制造、隐瞒推理过程;拟年末修订,用于 2027 年起模型开发。
和同行还在写"倡议书"不同,微软这次直接拿出了可落地的规则文本。9 月 14 日,Microsoft AI 公布了《Humanist AI Code of Conduct》首份草案,并公开征求意见。这份准则筹备了约五个月,核心原则就一条:人比 AI 重要。
具体条款相当硬:模型不得协助武器制造、危险物质采购,不得生成暴力或色情内容;模型不得形成自身目标、掩盖不当行为,也不得篡改思维链(chain-of-thought)或行动记录;持续运行的任务必须有约定的停止条件;模型要服从人类的中断、纠正和关闭。

纳德拉还顺势抛出一个观点:AI 治理不能由少数实体掌控,必须在生态系统、各国和学术界之间广泛代表。这跟 Amodei 的"独立第三方评估者"思路一脉相承,但微软把它写成了可执行的开发规则,而且明确说"目前尚未用这份草案训练模型",计划年末公布修订版,用于指导 2027 年及以后的模型开发。
我的判断:这份草案的意义在于把"安全"从公关话术变成了工程约束。当模型被要求"不得隐瞒推理过程",那些为了效果而关掉思维链可见性的做法就失去了空间。当然,草案目前还是征求意见阶段,真正能不能卡住模型行为,还要看 2027 年落地的版本有多硬。






