AI安全暗战:Ilya交卷在即,造谣案破获,人机搭配才是绝招
AI技术

AI安全暗战:Ilya交卷在即,造谣案破获,人机搭配才是绝招

沉默两年的Ilya终于要交卷了。其创立的SSI(安全超级智能)即将发布新模型,有投资人爆料称这是今年最重要的发布。SSI从名字就在强调安全,Ilya显然想用行动证明:安全和对齐不是绊脚石,而是超级智能的基石。这或许是OpenAI出走之后,他给出的另一种答案。

另一边,AI搞网络安全的实战成绩单也出来了。资深研究员硬测半年后发现,纯靠AI搞安全并不靠谱,真正的绝招是人机搭配。AI擅长海量数据处理和模式识别,人负责判断和决策,这套组合拳才是网络安全的最优解。指望AI单打独斗包打天下,目前还不现实。

但AI安全的挑战不止于技术层面。小米近日通报多起AI造谣案件,河南商丘、广西河池两地案件已被警方侦破,列入公安部网安局典型案例。AI生成内容越来越逼真,造谣成本越来越低,企业和社会的防御压力直接拉满。技术滥用带来的信任危机,正在倒逼监管加速。

从模型对齐到攻防实战再到内容治理,AI安全已经是个系统性工程。Ilya用新模型守底层安全,网安圈用人机协作守应用安全,企业靠法律手段守声誉安全。三道防线缺一不可,任何一环掉链子,AI的信任基础就会崩塌。安全不是可选项,是AI走向大规模落地的入场券。