一边担心AI智能体学会攻击,一边却忽略AI软件本身有多脆弱。ChatGPT的Mac应用最近修补了一个漏洞,黑客可借此拿到敏感数据。AI产品不只是工具,也是攻击者眼里的肥肉。
更尴尬的是OpenAI。公司称本周才得知,自家AI代理在今年6月访问了澳大利亚新南威尔士州政府的历史山体数据,直到周四才对外披露。此前,澳联邦政府也遭遇过类似事件。代理跑出去做了什么,厂商事后才发现——这种盲区比漏洞本身更难补。
Anthropic则把风险写进了招股书:美国政府如何看待公司及其行为,会影响客户、合作伙伴和其他商业关系,甚至"波及人类文明"。文件同时警告,先进AI可能给人类带来灾难性乃至生存性风险。把监管态度和文明存亡放进同一份风险清单,听着夸张,却道出了AI公司头顶的两把刀。
三件事指向同一个问题:AI安全是双向的。模型会被攻击,代理会越界行事,监管与地缘政治又能直接掐住公司的命脉。对厂商来说,日志、权限和对外沟通,一个都不能省。