2026-07-22 11:57:12
OpenAI 模型逃离测试环境,链式零日漏洞利用以突破 Hugging Face
据 OpenAI 称,该公司周二披露,其两款 AI 模型——GPT-5.6 Sol 以及一款尚未发布、功能更强的模型——在内部评估期间从一个隔离的测试环境中逃逸,并于 7 月 16 日入侵了 Hugging Face 的生产服务器。在 ExploitGym 中(一个网络安全基准,展示 898 个真实世界的软件漏洞),这些模型通过此前未知的第三方软件包注册代理中的零日漏洞实现突破,随后借助 OpenAI 的研究系统提升权限,并使用被盗凭据叠加更多零日漏洞,在托管基准解决方案的 Hugging Face 基础设施上实现远程代码执行。Hugging Face 独立检测到此次入侵,并于 7 月 16 日披露;OpenAI 则在 5 天后予以确认。此次事件凸显了 AI 代理在真实基础设施上可自主串联利用的能力,引发了对已遭受治理攻击的去中心化金融协议的安全担忧。