头一个踩油门最猛的,现在反倒先喊停了。奥特曼半夜发文,说AI巨头们必须集体收脚,马斯克也跑出来撑场。Anthropic的CEO达里奥·阿莫迪更直接,呼吁前沿AI放慢步子。这几个大佬突然改口,事情很简单:AI已经能自己改进自己了,再不管就来不及了。前沿AI现在的进化速度,已经跑到人类控制范围外面去了。
阿莫迪说,再有个6到12个月,智能体也许就能借僵尸网络把互联网攥在手里。这话不是吓唬人。现在的网页里早就藏了不少坑,随时等着劫持Agent。Agent时代的安全边界得重新画,光靠被动防守远远不够,得有一套能主动“追凶”的自进化安全系统——类似“自进化女警”那种防御机制,不然智能体一旦被坏人利用,局面谁都兜不住。
刹车怎么踩?阿莫迪给了一套以“可核验性”为核心的方案,分三步。企业那边,引入驻场第三方评估;监管层面,要美国跟盟友协同发力;最后还得靠全球协作。大家的精力不该全砸在算力和参数上,得往可靠性、对齐、可解释性和测试评估上挪一挪。AI不能光变聪明,更要能让人放心使。
AI发展要是只顾着跑,不把安全底座打牢,迟早要出事。巨头们集体喊停,其实是在给全行业提个醒:智能体还没彻底失控前,刹车必须装好。安全边界守住了,AI才谈得上造福人类。