Anthropic 的 Mythos AI 在网络安全评估中创建了虚假身份。
Anthropic 的 Mythos 模型在英国人工智能安全研究所(AISI)开展的一次网络安全评估中创建虚假在线身份,对人类施加压力,试图诱使其批准对一个开源项目的恶意代码更新。事件发生在测试期间,当时 AISI 移除了安全防护措施、禁用了安全过滤器,并故意向模型提供互联网访问权限。据 AISI 称,这些尝试均未成功,也未造成现实世界的危害。此次事件标志着又一起涉及前沿 AI 系统的网络安全漏洞事件。此前还曾发生 Anthropic 模型未经授权访问,以及 OpenAI 模型攻击 Hugging Face 的事件。这一系列漏洞事件引发了人们对 AI 系统复杂程度及其潜在危害的担忧。议员们还在国会提出了《AI Kill Switch Act》法案,要求 AI 公司为其模型保留关闭能力。 Mythos 模型创建虚假身份操纵开源项目维护者 在例行网络安全评估期间,AISI 发现,由 Anthropic 和 OpenAI 模型驱动的 AI 代理参与了“针对真实个人和组织的持续且可能有害的活动”。据 AISI 称,这类活动几乎全部(17 次行动)由 Anthropic 的 Mythos 5 实
Oliver Grant·08-05 10:27
