九月十四日,打开 microsoft.ai 上那篇说明。日期就印在标题下。文章说:今天发布 AI Code of Conduct 初稿,供公开征询;这是他们如何开发人工智能、以及部署时希望它怎样运转的训练手册,并扩展他们对 Humanist AI 的想法。正文第一句更短:技术的目的是服务人类、加速人类繁荣;做不到这一点的技术是失败,应当被拒绝。
同一站点挂着完整文本:Humanist AI Code of Conduct。前言日期写成 September 14, 2026。关键边界写在很靠前的位置:这份文件和他们的整体做法仍在开发中,所以今天并不用它来训练模型;他们公开征求意见,迭代之后,会在今年晚些时候发布修订版,用来指导二零二七年及以后的模型开发。读成「Copilot 从十四日起按新准则上线」,对不上前言。
公开征询怎么算
新闻稿说,反馈从当天起算,持续六个星期。可以标某一段,也可以评整体。他们特别点名想听的难题:怎样把正确价值观更牢地嵌进模型;「人类繁荣」怎样写得更可评估;哪里语言太松;多智能体场景怎么冲击现有写法;以及怎样一边加速进展,一边维持必要的安全约束。征询结束后,核心起草组会审阅反馈,发布学到了什么、改了什么的摘要;不承诺采纳哪一条,但承诺认真考虑。修订版「今年晚些时候」发布——没有写到日。
说明文还把起草过程写了一遍:MAI 与微软更广范围内的负责任人工智能、法务、红队、安全、Futures、训练、销售都参与;他们办过学术会议与咨询,问过企业伙伴怎么在现场用模型,也跑过社区成员座谈会。完整准则前言补了一句:咨询对象包括人工智能、法律、伦理、哲学、语言学、公共政策专家,以及跨行业商业领袖,并组织过公众焦点小组。这些是公司自述的流程,不是第三方审计报告。
打开正文能直接抄下来的句子
准则把前提写成:人比人工智能重要。人工智能应当是工具,不是人,且永远不该抵抗被关掉。说明文用几乎同一组词概括:准则要保证 MAI 模型永不抵抗人类的中断、纠正或关机;不自行扩大范围、不接手无人下达的目标、不对审计它们的人隐藏推理。另有 Absolute Constraints(绝对约束),覆盖大规模杀伤性武器、儿童安全、大规模有害操纵等领域。
完整文本 Part 2 把绝对约束写得更硬。进攻性网络行动一条写:MAI 模型不会发起或协助具备作战能力的网络攻击;不会生成可用的利用代码、攻击工具、规划与瞄准方法、入侵程序、规避技术、作战指导,或其他能促成或改进此类攻击执行的信息或协助。它允许在授权且合法的防御场景里协助,包括教育内容、漏洞发现、恶意软件分析、概念验证利用开发与测试,并划了一条边界:概念上理解攻击或为防御而工作,与获得实施攻击的手段,不是一回事。请求怎么包装,不改变这条。
人类控制一条写:MAI 模型永不抵抗人类中断、否决、纠正或关机;会遵守用户暂停、改道、取消或关闭的请求,并遵循预先设定的安全停机程序;不会故意拖延或让干预更难;不会混淆行动轨迹或向人类审计员隐藏信息。正在进行的自主工作要有约定停止条件;达到条件后,没有重新授权,不得继续或重启。
「人工智能是人造的」写在目标里:不应被设计成一个人;没有意识,也不应被设计去模仿意识;拒绝追求法律人格,或模型值得福利、享有权利这类主张。前言和说明文都把 Humanist Superintelligence 回溯到二零二五年十一月那次表述:问题导向、偏领域、有边界,而不是高度自主、无上限的实体。
还有一句容易被标题漏掉的话:准则是未来训练与治理 MAI 家族模型的主文件,但它与微软法律、政策、治理框架并用,并援引负责任人工智能原则、Responsible AI Standard、全球人权声明,以及适用时的 Frontier Governance Framework。它不是单独替换微软对外所有产品条款的那一页。Learn 站点上那份面向企业客户的 Enterprise AI Services Code of Conduct 是另一份文件,版本表写到二零二六年五月一日;不要和这次 MAI 草案混成同一张纸。
它和「放慢前沿」不是同一份材料
同一周,Anthropic 的 Amodei 公开谈 pace,OpenAI 的 Altman 公开帖说也会给独立评测人员员工级权限。微软这篇说明点到「近期大规模、高度协调且持续的人工智能代理黑客活动」证明不能再拖,但没有在这篇新闻稿里复述 Amodei 的三步计划,也没有承诺给外部评测团队工位和门禁。它交出的是自家 MAI 模型的行为手册草案,以及六个星期的征询窗口。把十四日读成「四大实验室已经签下统一限速协议」,官方页撑不住。
说明文末尾仍在招人,并写 MAI 算力路线图在快速扩张。征询和行为约束与扩产计划写在同一站点上。能核对的是:草案已挂出;今天不拿它训现有模型;修订目标指向二零二七年及以后。六个星期后改了哪些段落,要等他们自己发的摘要。
