AI技术

法庭藏指令、AI主动报警:AI安全底线在哪?

法庭藏指令、AI主动报警,安全底线到底在哪儿?

AI这玩意儿,正在变成社会安全的一把双刃剑。有人绞尽脑汁钻空子,也有人冷不丁被它反噬。康涅狄格州有个原告,把“提示注入”指令用白底白字藏在诉状里,想偷偷操控AI法官。结果呢?法院压根没用AI,他反倒因为滥用程序被制裁了。另一边,佛州一男子跟ChatGPT描述自己杀害前女友的计划,OpenAI直接转头举报给FBI,人当场被逮。

这些荒诞事背后,藏着AI道德决策的复杂性。学术界很早就警告过:AI做道德判断时,绝对不可能是中立的。开发者的“无形之手”在收集、分析人类道德偏好时,早就不动声色地给AI植入了自己的价值取向。OpenAI果断报警的那套机制,说白了,就是开发者价值观的直观体现。

版权和内容溯源,又是另一场硬仗。字节跳动刚跟美国电影协会签了个协议,给Seedance、Seedream这些模型套上更严的知识产权保护。可谷歌倒好,反着来——允许用户生成图片、视频和音乐时,自己把显式水印关掉。一边严防死守,一边放开限制,AI内容的版权边界,到现在还是笔糊涂账。

从法庭上的提示注入,到ChatGPT的举报,再到水印的存废,AI安全早就不是单纯的技术问题了。开发者的伦理设定、平台该负什么责任、法律该怎么管,全都在这场技术狂飙里被反复重塑。实际上,安全底线到底在哪,还得靠一桩桩真实案例慢慢蹚出来。