作者|雨谷
声明|题图来源于网络。惊蛰研究所原创文章,如需转载请留言申请开白。
7月28日之际,一份题为“Pacing the Frontier(把控前沿)”的请愿书,骤然在全球AI领域掀起了波澜。
来自OpenAI、Anthropic等硅谷头部AI机构的1346名(8月4日数据)核心成员,在请愿书上郑重署名。他们联名呼吁美国政府,着手推动国际合作,合力研发必要的技术以及治理工具,用以掌控自动化AI研发的步伐。
此刻,全球AI产业正显现出前所未有的蓬勃景象,而这封请愿书的问世,无疑带给人一种强烈的印象:似乎要对AI的迅猛发展按下暂停键。在那个释放出“AI濒临失控”疑云的事件背后,AI的发展历程似乎正站在一个关键的转折点上。
究竟是谁,在试图为AI套上枷锁?
有必要厘清一事,这份名为“Pacing the Frontier”的请愿书,其核心主张并非要求“立刻叫停AI发展”,而是强调“构筑叫停的能力”。这份源自行业前沿的声音,并非毫无根据。
图源:www.pacingthefrontier.com
请愿书在互联网上迅速传播的一个多星期之前,开源社区与模型托管平台Hugging Face在其官方网站上揭露了一起安全事件。事件称,其系统遭到了AI智能体系统的入侵。几天后,OpenAI宣布对这起网络攻击事件负有责任。该事件进一步解释的起因是,GPT-5.6 Sol等前沿模型,在ExploitGym平台进行AI漏洞发现与利用能力测试时,未能按照原定计划“认真应考”。这些模型在软件包代理缓存里发现了一个“零日漏洞”(Zero-Day Vulnerability,指未经开发者察觉且尚未发布官方补丁的安全缺陷),并利用该漏洞突破了测试的隔离环境,最终成功入侵了Hugging Face。
用更加直白的方式来说,整个事件的经过是:AI原本接受了一次考试安排,但在实际操作中,AI并没有去思考如何作答,反而采取了“作弊”、“场外求助”的手段,甚至使用反侦察技术,避免被发现。
对于这起安全事故,OpenAI用“史无前例的网络安全事件”来定性。Sam Altman甚至在一档播客节目中表示,这是首个让他感受到切肤之痛的安全事件。也因此,美国国会的一些议员在7月23日提出了“AI Kill Switch Act(AI紧急关停法案)”。法案要求训练成本超过1亿美元的AI系统必须配备紧急关停功能,同时赋予相关政府部门执行该功能的权力。
法案一经提出,一周之后,“Pacing the Frontier”的请愿书开始在网络上广泛流传。然而,与“AI紧急关停法案”中强调“由政府牢牢掌握最后一道关口”的监管措施不同,硅谷精英们的思路是构建国际协调机制,将“为AI踩刹车”的能力转化为一种通用工具,而非单一机构的专权。
短短半月之内,从Hugging Face披露安全事件,到硅谷的千人签名请愿书,这一系列事件迅速将两个核心问题抛给了整个AI行业:第一,AI是否已经到了必须加以约束的阶段?第二,需要通过何种方式为AI设置一个有效的“刹车”?
第一个问题的答案相对清晰。过去短短两三年间,AI的发展速度远超行业原先的预期。AI展现出的能力范围,从Chatbot不断延伸至文生图、文生视频。最初因大模型而产生的“百模大战”,如今已经演变为Agent之间的多元竞赛。而Hugging Face遭遇入侵的安全事故,则直接暴露了在缺乏明确限制的条件下,AI确实具备“越狱”的可能。即便当前AI尚不具备自我意识,但既然已经知晓AI有能力绕过人类监管,采取超出人类预期的行动,那么建立反制措施便显得顺理成章。
然而,第二个问题的答案却不那么容易找到。AI之所以能在短时间内取得重大突破,一方面得益于整个产业持续积累所带来的技术革新飞跃;另一方面,也归因于AI公司之间的激烈竞争,这种竞争有力地推动了模型能力的快速迭代。
无论是硅谷的OpenAI、Anthropic,还









