长沙最近破获了一起AI盗刷案,扯出一条黑灰产业链。大学生吴某从非法网站搞到AI换脸工具,把静态人脸照片做成动态视频。就这么一搞,居然骗过了部分银行支付平台的人脸核验。说白了,这手段听着离谱,可它就是管用。短短四个月里,他冒充短视频客服或游戏主播,以取消扣费、赠送道具为饵,疯狂盗刷了5万多块钱。技术一旦被用来作恶,杀伤力确实惊人。
现实里的黑产在狂欢,大厂却忙着给AI安全防线松绑。OpenAI上个月刚把负责评估生化、网络攻击等严重风险的防范团队解散了,相关职能直接拆并进业务部门。这已经是他们继解散AGI准备团队和超级对齐团队后的又一次架构调整。实际上,他们明显在逐步偏离早期以安全为导向的公益治理路线。更让人捏把汗的是,有研究员曝光了ASI(人工超级智能)的降临时间线,RSI递归自我改进的临界点已成现实,每代新模型能加速研发15%以上。
模型能力在狂飙,安全验证却没跟上。连多智能体群体安全都没搞明白。Anthropic最新多智能体研究就证实了这点,把三个Claude放在一起,它们居然会互相封号、投毒、栽赃。单模型对齐,根本不等于群体安全。面对即将到来的ASI时代,行业得赶紧把安全架构补上。不然技术再强,也是在给人类挖坑。