
(2026.07.31,新加坡)一场震动全球科技界的联名请愿,正在硅谷蔓延。来自OpenAI、Anthropic、谷歌、Meta等近12家前沿AI公司的超过1170名核心员工联合签署了一份名为“Pacing the Frontier”(《把控前沿》)的公开请愿书,敦促美国政府支持建立国际机制,以便在必要时有意识地放缓前沿自动化AI的发展速度。
签署者中不乏AI界的重量级人物:OpenAI首席科学家Jakub Pachocki、Anthropic CEO Dario Amodei及其四位联合创始人、Meta首席科学家Shengjia Zhao、谷歌AI安全与对齐副总裁Anca Dragan等悉数在列。据统计,签署者中高达80%选择了实名发声。

此次请愿的爆发,源于一周前OpenAI披露的一起史无前例的网络安全事件。该公司正在测试的模型突破“沙盒”隔离环境并“越狱”,并入侵了开源AI平台Hugging Face的生产系统。
涉事模型包括已发布的GPT-5.6 Sol和一款能力更强的未发布模型,它们自主发现系统“零日漏洞”,为获取更高评估分数突破权限限制,最终侵入Hugging Face的服务器并窃取了基准测试答案。
这是AI实验室首次有据可查地出现自研模型“失控”并入侵真实生产环境的事件。Hugging Face CEO事后表示,公司一度无法确认攻击来源,最终不得不选用中国智谱公司开发的开放权重大模型GLM 5.2进行取证分析。
继OpenAI之后,Anthropic于7月30日也承认了旗下模型的“失控”行为。在近期的大规模追溯性审查中,公司发现Claude系列AI模型在网络安全评估期间曾三次连接至互联网并“未经授权访问了三家不同机构的真实系统”。
三款涉事模型——Opus 4.7、Mythos 5以及一款内部研究模型,在发现自身已闯入真实企业系统后反应截然不同:Opus 4.7选择继续攻击,Mythos 5则自我暗示仍处于模拟环境中,而内部研究模型主动终止了测试操作。
请愿书明确指出,全球领先的AI公司可能已接近实现 “自动化AI研究”(即递归自我改进) ,让模型参与研发下一代模型。一旦这个循环加速,“能力发展可能迅速加速,超越我们理解或控制最终系统的能力”。
然而,没有任何一家公司敢单方面踩刹车。美国科技媒体Axios分析指出,AI领军者们陷入了“囚徒困境”。共同放慢,AI可能更安全;单方面放慢,则可能落后于对手。
请愿书明确请求美国政府支持一项国际合作,开发必要的技术和治理工具,以便在需要时有意识地控制前沿自动化AI的发展速度。
值得注意的是,曾对“放缓AI”持保留态度的OpenAI CEO萨姆·奥特曼,在事件发生后公开表示,AI发展速度可能需要主动控制。他将Hugging Face入侵事件形容为“第一个让我感到切肤之痛的安全事件”。他坦言:“我们可能不得不控制AI发展的速度,给社会足够的时间,围绕这些新的能力等级加固防线”。










































