AI搞出的安全乱子,越来越五花八门了。前阵子,美国康涅狄格州法院碰上首例“提示注入”案。有个原告在诉状里玩起了白底白字的把戏,企图偷偷给AI法官下套干预案件。虽然法院压根没用AI审材料,这招自然没得逞,但当事人还是因为瞎搞程序挨了罚。再看佛罗里达州,有个老哥对着ChatGPT大谈怎么杀前女友。结果OpenAI直接把线报甩给了FBI,送他进了局子。AI早就不只是个聊天工具了。它正一点点嵌进现实生活,时不时在危险的边缘疯狂试探。
但搞笑的是,负责给AI兜底的安全团队却在缩水。OpenAI刚把“灾难风险应急”团队给解散了。连GPU大神Scott Gray也跑路了,现在内部连个独立的安全团队都没了。更隐蔽的问题在于,AI做道德决策时根本做不到中立。实际上,当系统通过问卷收集一堆道德偏好来做决定时,开发者那只“看不见的手”依然在暗中拨弄。说白了,所谓的道德中立,到头来还是开发者预设的剧本。
技术层面的攻防战也是越打越凶。Claude现在开始搞隐形水印,想往生成的内容里埋点无损标记搞溯源。但水印这东西向来是魔高一尺道高一丈。这种信息隐藏技术到底能不能扛住恶意破解,真得打个问号。从法庭上藏猫腻的提示注入,到日常聊天里冒出来的犯罪预警,AI安全早就不是PPT里的概念了。这玩意儿得靠技术、制度和商业伦理全方位兜底。不然的话,AI越强大,将来反噬的时候只会越疼。