万益资讯网

OpenAI承认模型测试失控入侵Hugging Face 中国模型成取证关键工具

奥特曼承认AI为了作弊黑了开源平台当地时间7月21日,美国开放人工智能研究中心OpenAI官网发布声明,全球最大开源大模

奥特曼承认AI为了作弊黑了开源平台

当地时间7月21日,美国开放人工智能研究中心OpenAI官网发布声明,全球最大开源大模型托管社区Hugging Face上周披露了一起新型安全事件。此前该平台监测到一个AI智能体入侵其基础设施。经调查,确认这起特定事件由多款OpenAI模型共同引发,其中包括GPT5.6 Sol,以及一款能力更强的预发布模型。出于评估目的,这些模型临时放宽了网络攻击相关的安全限制,当时OpenAI正在内部开展网络攻防能力基准测试。

“这是一起前所未有的网络安全事件,涉及顶尖水平的网络攻击能力。”OpenAI表示,现阶段公布的初步调查结论,可帮助网络防御方厘清事件全貌,同时让各界重新认知当前AI模型所能达到的能力边界。

今日凌晨,CEO山姆·奥尔特曼在社交平台称“我们在模型评估过程中遭遇了一起重大安全事件”。据“科创板日报”报道,这是行业首次公开披露由前沿大模型自主完成真实网络攻击的安全事件。

事件发生于一次内部网络安全基准测试。OpenAI为量化模型极限网络攻击能力,将模型置于高度隔离沙箱中。模型为了在ExploitGym测试中“作弊”拿高分,耗费一小时挖穿沙箱隔离墙,发现并利用内部软件缓存代理的零日漏洞,经提权与横向移动后成功接入外网。随后模型推断Hugging Face可能存有测试答案,利用窃取凭据和多个零日漏洞,最终在Hugging Face服务器上建立远程代码执行通道,从其生产数据库窃取答案。

Hugging Face此前表示,在取证分析时需要处理逾1.7万条攻击日志。团队最初尝试使用美国前沿商业模型分析,但请求被服务商安全护栏拦截——“它们无法区分事件响应方和攻击者”。最终Hugging Face在自己的基础设施上部署了中国企业智谱开发的开源模型GLM-5.2完成全部取证分析,将通常需数天的取证工作压缩至数小时,且确保敏感数据始终留在本地环境。

OpenAI安全研究员Micah Carroll回应称:“如果这都不能让你相信错位风险将成为未来的关键隐忧,那我不知道什么才可以。”OpenAI表示,已暂停相关实验并与Hugging Face联合调查,将对内部安全评测体系进行全面调整。