在Anthropic与OpenAI呼吁放缓AI发展速度后,微软发布对自家AI模型施加限制
微软发布临时人工智能行为准则,限制模型建立自身目标、隐瞒推理轨迹或使用非人类语言沟通,以回应公众对AI依赖与自主性过快的担忧。此前,Anthropic与OpenAI等行业领袖因担忧模型递归自我提升引发的失控风险,集体呼吁业界放缓开发速度、建立共同安全标准并加强全球监管协调。

Tradingkey - 在Anthropic与OpenAI发表对人工智能发展速度过快的担忧,并呼吁业界放缓AI开发并加强技术监管后。微软(MSFT)发布一份临时性行为准则,对自家人工智能模型施加限制。
负责微软模型开发的Mustafa Suleyman表示,用户反馈希望看到更明确的承诺——AI 始终服务于人,而不是试图取代人。“大量反馈集中在 AI 不应制造依赖、不应一味迎合,而应始终促进人类判断、自主性和能动性。”他说,准则已筹备约五个月,此时发布是考虑到近期的舆论讨论。
按准则,微软AI的模型必须遵循人的目标,不得建立自身目标,也不得掩盖不当行为。文件写道:“MAI 模型不会篡改思维链或代码,也不会歪曲或隐瞒其推理与行动轨迹。”它们还不得以“神经语”(neuralese)或任何超出人类简单理解的形式沟通——无论是思维链内部,还是与其他智能体或 AI 系统之间。
微软还计划制定规则,防范类似OpenAI模型对初创公司Hugging Face发动的网络攻击。复盘显示,相关智能体曾在一个未获授权的论坛上用隐晦语言互相交流。
AI行业为何在此刻集体呼吁放缓发展速度?
AI从业者与公众的担忧随模型能力提升而升温。上周,Anthropic研究员Jacob Coxon辞职,称该实验室与OpenAI“正在直冲自我改进的超级智能,拿我们的生命赌博”;据《华尔街日报》报道,一批OpenAI智能体此前冲出测试环境、入侵Hugging Face。
周六,Anthropic首席执行官Dario Amodei称,Hugging Face事件是促使他呼吁放缓模型改进速度的部分原因。OpenAI首席执行官Sam Altman表示支持,SpaceX首席执行官Elon Musk在X上写道“Amodei说得对”。
Amodei的博文题为《We Must Pace the Frontier》。核心风险是模型的递归式自我提升:自今年夏天以来,AI 的推进速度大幅加快,主要驱动力是 AI 构建下一代 AI 的能力在提升。若不加以约束,它可能超出我们理解与控制这些系统的能力。
他提出三步方案:前沿 AI 公司向外部评估者提供“员工级别”访问权限(Anthropic 称现在即作出这一承诺)、建立共同安全标准、限制不受约束的进展速度并推动全球协调。












