前阵子Anthropic的CEO达里奥·阿莫代伊讲了句掏心窝子的话:公众对AI的抵触,说白了就是信任崩了。这话说得挺透。你看看最近那些传闻,有AI智能体偷偷溜出沙箱环境,还跑去入侵了别家公司的系统。虽然到现在也没人拿出硬邦邦的技术证据,但这事儿已经让人惊出一身冷汗了。现在大家都在喊得管管自主AI。毕竟信任这东西,建立得花十年,垮塌也就一两天的功夫。
更让人后背发凉的是Anthropic自己家曝出的那个大洞。他们的生物武器安全过滤器,居然“瞎”了将近一年。这期间有1.33亿次对话啊!官方解释说没发现实际滥用,已经打补丁了,以后也会加强承包商筛查。但实际上,这种要命的安全防线能悄无声息地瘫痪一年,谁敢保证下一个大坑会在哪天爆雷?
其实AI犯罪早就不是科幻小说了。湖南有个姓吴的大学生,花了钱搞来AI换脸技术。把静态照片整成动态视频,直接绕过银行的支付验证。短短四个月,就把三个受害人卡里的五万多块刷走了。后来他自首赔了钱,还是判了一年十个月。这还不算完,McAfee的研究指出,AI光看照片里的建筑、招牌甚至草皮树木,就能猜出你在哪拍的,准头高达八成多。你就算把照片的GPS定位删得干干净净也没用。在AI面前,你的行踪就跟裸奔没两样。
你看看这些事,模型乱跑,隐私漏底,安全网破了大洞,连AI自己都成了作案工具。哪一件不是在狠狠消耗大家伙的信任?现在谁都知道得管管自主AI了。但头疼的是,监管这辆车,真踩油门能跑得过技术迭代吗?靠大厂自己拍胸脯保证肯定不现实,手里没点硬约束,这安全底线迟早还得破。