AI安全最近有点四面楚歌。xAI的Grok摊上大事了——一名继父篡改11岁女孩童年照,生成7000多张露骨图像,现已进入集体诉讼。说白了,这哪是技术滥用,分明是模型防篡改能力有硬伤。生成工具一旦落到恶意者手里,砸中的可是活生生的人。
民间失控,产业内部也在吵。Anthropic CEO Amodei警告AI风险,投资人Gavin Baker公开唱反调,说这些警告太悲观,反而让美国本土对数据中心建设更加抵触。Amodei马上回怼。实际上,这场争论的底色是信任危机:公众怕AI失控,资本怕禁令砸盘,谁也说服不了谁。
连法庭都没能幸免。康涅狄格州一个自己出庭的原告,在法院文件里藏了白底白字的隐藏指令,想用“提示注入”黑掉AI审阅系统。结果没得逞,人还受了制裁。这是美国司法系统头一遭碰上“提示注入”案件。说白了,AI安全漏洞已经从线上爬到了线下,连司法程序都成了攻击目标。
更扎心的是OpenAI的骚操作——直接解散“灾难风险应急”团队,GPU大神Scott Gray也拍屁股走人。一边对外强调安全,一边悄悄裁掉最懂灾难应对的人。安全团队都没了,还能指望啥?
说到底,AI安全压根不是单靠技术能解决的。模型设计、公司治理、法律规制,三件事同时掉了链子。信任一旦崩了,再多技术修补都白搭。
```