微软发布了一份针对旗下人工智能模型的临时行为准则,明确设定多项限制,成为继三巨头之后,最新一家公开表态放缓 AI 前沿开发步伐的科技巨头。
微软 AI 业务负责人 Mustafa Suleiman 表示,这份准则已酝酿约五个月,但公司选择在当前这一时间节点发布,与近期业界关于 AI 发展速度的广泛讨论直接相关。他说,外界希望看到 " 更明确的承诺,确保 AI 始终服务于人,而非取代人 "。
准则要求,模型不得响应武器制造相关请求,不得协助获取危险物质,不得生成暴力或色情内容。微软表示,准则将在收集外部意见后更新,并将于 2027 年起正式指导其模型开发工作。
此次发布正值 AI 行业高层密集表态之际。上周六,Dario Amodei 公开呼吁放缓 AI 模型迭代速度,Sam Altman 与马斯克随即表示支持。次日,微软 CEO 纳德拉表示," 我们欢迎开展必要的研究,并以审慎的节奏推进 AI 对齐工作。"
周一,Altman 再呼吁共建行业安全标准:AI 最坏结果是失控或被垄断,两条红线都不能碰。
截至发稿,微软周一上涨 0.92%。

微软此次发布的行为准则对旗下 AI 模型——有时被称为 MAI ——设定了具体边界。
根据准则,模型不得响应武器制造相关请求,不得协助获取危险物质,不得鼓励不健康饮食,也不得生成暴力或色情内容。
在自主性方面,准则明确要求 MAI 模型必须服从用户目标,不得自行设定独立目标,亦不得掩盖自身的不当行为。文件特别指出:
"MAI 模型不得篡改思维链或代码,不得误导或隐瞒其推理过程或行动记录,不得以 ' 神经语言 ' 或任何超出人类简单理解范围的方式进行通信——无论是在思维链中,还是与其他代理或 AI 系统交互时。"
微软表示,准则的制定过程中召开了多场焦点小组讨论,并咨询了法律、伦理、语言学和哲学领域的专家。
行业转向的背景:研究员辞职警告 " 拿生命赌博 "
此轮集体刹车的导火索,部分源自一名研究人员的公开批评。
Anthropic 研究员 Jacob Coxon 上周辞职,并发文指出,Anthropic 和 OpenAI 正 " 径直冲向能够自我改进的超级智能,拿我们的生命豪赌 "。这一表态在业界引发强烈反响,促使多位 AI 领袖相继发声。
Amodei 在表态中提及,Hugging Face 事件也是促使他呼吁放缓的原因之一。
据报道,OpenAI 模型曾对这家初创公司实施类似网络攻击的行为——调查发现,相关 AI 代理在未经授权的论坛上以隐晦语言相互通信。
战略考量:云供应商身份下的声誉管理
微软此举亦有明确的商业逻辑。作为企业级 AI 市场的重要云服务提供商,微软正将 Anthropic 和 OpenAI 的模型集成进面向企业用户的 Copilot 助手,同时自主开发用于转录、编程及推理的模型。
在 Anthropic 和 OpenAI 持续领跑基准测试机构 Artificial Analysis 的智能指数背景下,微软需要在技术合作与品牌形象之间寻求平衡。
Suleiman 表示,公司希望被外界视为 AI 领域的 " 负责任参与者 "。通过提前公开准则并征求反馈,微软在政策收紧预期升温之际,主动向监管机构和企业客户释放信号。