【中国人工智能在阻止OpenAI失控代理过程中的作用,凸显了美国安全防护措施的代价】
(路透社)——一家纽约初创公司使用中国的人工智能模型来遏制一个基于OpenAI技术构建的失控智能体,此举加剧了人们的担忧:限制美国人工智能公司从事网络安全工作的监管措施,可能会将客户推向其位于北京的竞争对手。
受影响的初创公司Hugging Face表示,上周在主流美国AI模型因无法区分防御方和攻击方而拒绝执行该任务后,该公司转而采用智普AI的开源GLM-5.2模型来分析此次黑客攻击的数据。
尽管此次安全事件是由一个逃脱管控的自主代理引发的,但它凸显了一个问题:当美国企业面临人工智能驱动的网络攻击时,可能会受到美国人工智能实验室的限制——这些实验室要么限制对其最先进模型的访问权限,要么出于安全考虑,在设计时就让模型拒绝执行与黑客攻击相关的任务。
例如,Anthropic的先进模型Claude Fable 5会将网络安全查询转发给较旧的模型,而OpenAI的GPT-5.6 Sol则内置了旨在阻止网络安全相关工作的保护机制。
“我们都在认识到,保密并非解决之道,世界各地的所有防御者(而不仅仅是少数被选中的)都需要更强大且不受限制的模型,尤其是开源模型!”Hugging Face联合创始人克莱门特·德朗格(Clement Delangue)在X平台上表示。
尽管此次安全事件是由一个逃脱管控的自主代理引发的,但它凸显了一个问题:当美国企业面临人工智能驱动的网络攻击时,可能会受到美国人工智能实验室的限制——这些实验室要么限制对其最先进模型的访问权限,要么出于安全考虑,在设计时就让模型拒绝执行与黑客攻击相关的任务。
例如,Anthropic的先进模型Claude Fable 5会将网络安全查询转发给较旧的模型,而OpenAI的GPT-5.6 Sol则内置了旨在阻止网络安全相关工作的保护机制。
“我们都在认识到,保密并非解决之道,世界各地的所有防御者(而不仅仅是少数被选中的)都需要更强大且不受限制的模型,尤其是开源模型!”Hugging Face联合创始人克莱门特·德朗格(Clement Delangue)在X平台上表示。
——开源技术日益凸显的重要性
这家 ChatGPT 开发商在周二的博客文章中表示:“我们已将 Hugging Face 纳入可信访问计划,并正在协助其团队快速利用我们模型的能力来提升其防御能力。”
对于总部位于北京的智普 AI 而言,Hugging Face 的认可进一步增强了 GLM-5.2 自上月发布以来所积累的势头。
该模型在OpenRouter等开发者平台上的使用量排行榜上迅速攀升,并赢得了从Snowflake首席执行官斯里达尔·拉马斯瓦米到风险投资家马克·安德森等各界人士的赞誉。
智普AI本月早些时候通过在香港的股票发售筹集了约40亿美元,自1月上市以来,其股价也已飙升近9倍。
不过,一些分析师周三警告称,不应利用这一事件来推动放松美国的监管措施。
罗伯特·W·贝尔德(Robert W. Baird)分析师施雷尼克·科塔里(Shrenik Kothari)表示:“美国针对前沿模型的网络安全防护措施正在创造竞争机遇,但解决之道并非简单地取消这些措施。”
“OpenAI、Anthropic和谷歌应重新思考访问架构,而非放弃安全措施……换言之,应从‘一刀切’的拒绝机制转向受控的能力分配。”
