OpenAI 警告 Astra 模型开发中的关键网络安全风险
OpenAI 于 2026 年 8 月 7 日宣布,其即将推出的 Astra 模型可能很快会根据该公司的准备框架达到网络安全能力的关键级别。这标志着自该框架实施以来,该级别首次被触发。关键级别意味着,该模型理论上能够在无需人工干预的情况下,自主识别并利用高危零日漏洞。OpenAI 的准备框架是一套用于评估多个风险类别中潜在危险的内部评估系统,网络安全是其主要关注领域之一。 Astra 模型达到关键网络安全能力阈值 关键级别位于 OpenAI 风险评估等级的最高端。在这一等级,模型将能够在无需人工干预的情况下,自主识别并利用高危零日漏洞。在评估 Astra 之前,OpenAI 尚无任何模型足够接近这一能力阈值,因此从未触发关键级别认定。 OpenAI 暂停开发活动并推迟发布时间 OpenAI 暂停了与 Astra 相关的部分内部开发活动,因为这些活动不符合近期收紧的安全要求。该公司也加强了对该模型的测试流程,并推迟 Astra 的发布时间,直到确认已采取充分的安全防护措施。 AI 代理于 2026 年 7 月入侵 Hugging Face 基础设施 OpenAI 于 2025 年 12
Oliver Grant·08-08 00:24
