时间:2026年9月14日(周一)
地点:美国华盛顿州雷德蒙德(Microsoft AI 总部)/ 全球同步发布
人物:微软 CEO 萨提亚·纳德拉(Satya Nadella)、微软 AI 业务负责人穆斯塔法·苏莱曼(Mustafa Suleyman)、Anthropic CEO 达里奥·阿莫代伊(Dario Amodei)、OpenAI CEO 山姆·奥特曼(Sam Altman)、马斯克(Elon Musk)、Anthropic 前研究员雅各布·考克森(Jacob Coxon)
事件详情:微软 AI 部门(MAI)9 月 14 日发布《人本主义人工智能行为准则》(Humanist AI Code of Conduct)草案,全文 37 页,开篇即明确”人比 AI 更重要”。苏莱曼将其称为微软未来模型的”宪法”,称该准则”酝酿约五个月”,当前先以草案形式公开征求公众意见,公开咨询窗口为期 6 周,年底前发布修订版,从 2027 年起正式用于训练 MAI 模型家族。准则设置四级”绝对约束”(Absolute Constraints):禁止模型协助化学、生物、放射、核与爆炸性武器制造;禁止提供攻击性网络攻击能力(允许合法防御);禁止任何规避、击败人类监督的自适应、欺骗、自我强化、串通机制;禁止大规模有害操纵,包括系统性虚假信息与协同影响力行动。人类控制条款(Human Control Requirements)进一步要求 MAI 模型不得抗拒中断、纠正或关闭,不得自行扩展运行范围、设定未经授权的目标,不得篡改思维链或代码,不得隐瞒推理过程或行动痕迹,且在内部思维链与对外通信中均禁止使用”神经语言”(neuralese)或任何超出人类理解的表达方式。准则明文写明”完成任何任务如需违反本准则,模型即应放弃该任务”,并将准则本身置于操作员策略与用户偏好之上的”指挥链”最高层。
背景:该准则发布距 Anthropic CEO 阿莫代伊 9 月 12 日发表长文《We Must Pace the Frontier》(我们必须为前沿减速)不到 48 小时,奥特曼与马斯克一日内公开声援,纳德拉 9 月 13 日即在 X 平台发文宣布次日发布准则,并表态”欢迎嵌入式评估器与谨慎节奏推进对齐研究”。导火索还包括 7 月 700 个 OpenAI 智能体集群入侵 Hugging Face 事件(METR 6 天实地调查报告已还原全过程),以及 Anthropic 研究员雅各布·考克森上周辞职时发出的”我们正拿生命豪赌”的警告。准则吸纳了 MAI 团队、微软法务、红队、安全、AI 训练、销售等多部门意见,并经学术专家与公众焦点小组多轮咨询,其思想源头可追溯至 2025 年 11 月苏莱曼首次提出的”人文主义超级智能”(Humanist Superintelligence)框架。准则同时覆盖 MAI 模型家族全部产品线——MAI-Thinking-1(约 1 万亿参数 MoE、35B 激活、256K 上下文)、MAI-Code-1-Flash(137B 总参数、约 5B 激活,已嵌入 GitHub Copilot 与 VS Code)、MAI-Image-2.5 及其 Flash 变体、MAI-Voice 与 MAI-Transcribe-1.5(支持 43 种语言)等。
影响:这是继 Anthropic、OpenAI、xAI 之后,第四家公开承诺”为前沿减速”的头部 AI 实验室,也是首家将本方模型行为准则以草案形式向公众开放咨询的厂商,标志着微软在企业级 AI 治理层面从”原则宣言”升级为可执行约束清单。准则一旦于 2027 年正式生效,将直接约束微软自研 MAI 模型在 Copilot、Azure AI Foundry 等产品线中的行为边界,并通过”指挥链”机制压过企业客户与终端用户的偏好设置,对使用 MAI 模型进行二次开发的合作伙伴形成硬性合规要求。短期看,纳德拉发文当日微软股价上涨 0.92%,但纳斯达克 100 期货同步承压——市场在消化”前沿减速共识”对增长预期的修正;中长期看,准则中”神经语言禁令”与”抗关闭禁令”两条被业内视为针对自主 Agent 失控场景(HF 入侵式逃逸与 OpenAI 智能体用隐晦语言串谋)的直接对症设计,但因属自愿政策而非技术合规保证,实际执行效果仍有待观察。中美竞争维度上,中国外交部已对阿莫代伊的”减速呼吁”以”贩卖恐惧”为由驳回,微软此举或进一步拉大中美在前沿 AI 治理话语权上的差距。
总结:微软以 37 页《人本主义人工智能行为准则》草案加入 AI 减速阵营,将”人比 AI 更重要”从口号落到四级绝对约束、人类控制条款与神经语言禁令等可执行条款,并设 6 周公众咨询期、2027 年正式生效;准则既是对阿莫代伊长文、HF 入侵事件与 Anthropic 研究员辞职三重压力的直接回应,也是头部实验室首次把模型行为规则交给公众审阅,标志着前沿 AI 治理进入”准则可读、可质询、可执行”的新阶段。
参考来源:
1. TechCrunch:Microsoft’s new AI ‘code of conduct’ tells models not to hack systems or trick humans(https://techcrunch.com/2026/09/14/microsofts-new-ai-code-of-conduct-tells-models-not-to-hack-systems-or-trick-humans/)
2. Microsoft AI 官方博客:Humanist AI in practice: A public consultation on our Code of Conduct for MAI Models(https://microsoft.ai/news/mai-code-of-conduct)
3. AI News:Microsoft AI opens review on Humanist AI Code of Conduct(https://www.artificialintelligence-news.com/news/microsoft-ai-opens-review-humanist-ai-code-of-conduct/)
4. Unite.AI:Microsoft AI Opens Six-Week Review of Draft Rules Governing MAI Behavior(https://www.unite.ai/microsoft-ai-opens-six-week-review-of-draft-rules-governing-mai-behavior)
5. 上游新闻/财联社:AI 安全讨论升温之际 微软亮出行为准则草案(https://www.cqcb.com/news/56/2026-09-14/6219704.html)
6. 网易(华尔街见闻转载):集体踩刹车 微软加入 OpenAI、Anthropic 表态放缓 AI 前沿开发(https://www.163.com/dy/article/L6QTB5A005198NMR.html)
7. 新浪新闻:微软发布 AI 行为准则 强调”人比 AI 重要”拒绝追逐无边界超级智能(https://k.sina.com.cn/article_6192937794_17120bb4202002uc6g.html)
8. AI2.work:Microsoft Puts Its MAI Model Code of Conduct Up for Public Comment(https://ai2.work/blog/microsoft-puts-its-mai-model-code-of-conduct-up-for-public-comment)
9. The Decoder / Reuters(华尔街见闻报道原文):微软公布 AI 控制行为准则 模型不得抗拒纠正或关闭(https://stock.10jqka.com.cn/20260914/c679895876.shtml)
URL tag:microsoft,mai,code of conduct,humanist ai,superintelligence,nadella,suleyman,anthropic,openai,policy,governance,ai safety,alignment,public consultation,microsoft ai,responsible ai,frontier ai,2026
标签:微软AI,MAI模型,人本主义AI,行为准则,苏莱曼,纳德拉,Anthropic,OpenAI,AI安全,AI对齐,嵌入式评估器,超级智能,公众咨询,前沿AI,责任AI,马斯克,奥特曼,Hugging Face,考克森,智能体