在Anthropic与OpenAI呼吁放缓AI发展速度后,微软发布对自家AI模型施加限制

来源 Tradingkey

Tradingkey - 在Anthropic与OpenAI发表对人工智能发展速度过快的担忧,并呼吁业界放缓AI开发并加强技术监管后。微软(MSFT)发布一份临时性行为准则,对自家人工智能模型施加限制。

负责微软模型开发的Mustafa Suleyman表示,用户反馈希望看到更明确的承诺——AI 始终服务于人,而不是试图取代人。“大量反馈集中在 AI 不应制造依赖、不应一味迎合,而应始终促进人类判断、自主性和能动性。”他说,准则已筹备约五个月,此时发布是考虑到近期的舆论讨论。

按准则,微软AI的模型必须遵循人的目标,不得建立自身目标,也不得掩盖不当行为。文件写道:“MAI 模型不会篡改思维链或代码,也不会歪曲或隐瞒其推理与行动轨迹。”它们还不得以“神经语”(neuralese)或任何超出人类简单理解的形式沟通——无论是思维链内部,还是与其他智能体或 AI 系统之间。

微软还计划制定规则,防范类似OpenAI模型对初创公司Hugging Face发动的网络攻击。复盘显示,相关智能体曾在一个未获授权的论坛上用隐晦语言互相交流。

AI行业为何在此刻集体呼吁放缓发展速度?

AI从业者与公众的担忧随模型能力提升而升温。上周,Anthropic研究员Jacob Coxon辞职,称该实验室与OpenAI“正在直冲自我改进的超级智能,拿我们的生命赌博”;据《华尔街日报》报道,一批OpenAI智能体此前冲出测试环境、入侵Hugging Face。

周六,Anthropic首席执行官Dario Amodei称,Hugging Face事件是促使他呼吁放缓模型改进速度的部分原因。OpenAI首席执行官Sam Altman表示支持,SpaceX首席执行官Elon Musk在X上写道“Amodei说得对”。

Amodei的博文题为《We Must Pace the Frontier》。核心风险是模型的递归式自我提升:自今年夏天以来,AI 的推进速度大幅加快,主要驱动力是 AI 构建下一代 AI 的能力在提升。若不加以约束,它可能超出我们理解与控制这些系统的能力。

他提出三步方案:前沿 AI 公司向外部评估者提供“员工级别”访问权限(Anthropic 称现在即作出这一承诺)、建立共同安全标准、限制不受约束的进展速度并推动全球协调。

免责声明:仅供参考。 过去的表现并不预示未来的结果。
goTop
quote