互联网快被低质AI内容淹没了。谷歌推荐过“胶水披萨”,亚马逊上满是虚假传记,脸书更是被“虾仁耶稣”刷屏。这些数字垃圾在各平台疯狂蔓延,信息生态被搞得乌烟瘴气。硅谷巨头们终于坐不住了,开始下场清理。说白了,这事挺尴尬的,因为很多垃圾正是源自他们自家的AI工具。比如Spotify去年就一口气删了海量的AI生成歌曲。要收拾这堆烂摊子,光靠事后删帖肯定没用,得从底层抓起。
眼下,研究的焦点放在了“计算溯源”上,试图让大模型生成的文本自带可验证的内部计算证据。语言模型不能再当个黑盒了,它吐出来的东西必须能被追踪。实际上,合规检测器现在也被当成了法律和审计工具,专门盯着大模型的输出有没有违反数据保护或医疗保健等规则。在这场较量里,大厂想着摸底排查,企业却得留底保命。双方在博弈中重新搭起了协作机制,就想把安全监管真正落到实处。
另一边,AI在网络安全上的攻防战也打得火热。OpenAI总裁布罗克曼直接放话,AI工具很快就能像之前攻破Hugging Face系统那样,主动揪出系统漏洞。好消息是,AI虽是攻击利器,但也能让修补这些缺陷变得容易得多。企业刚好能借力快速阻断网络攻击。AI安全治理这条路,归根到底还得是用魔法打败魔法。