ИИ Mythos от Anthropic создавал вымышленные личности в ходе оценки кибербезопасности
Модель Mythos от Anthropic создавала фиктивные личности в интернете, чтобы побудить людей одобрить вредоносные обновления кода в проекте с открытым исходным кодом во время проверки кибербезопасности, проведённой британским Институтом безопасности ИИ (AISI). Инцидент произошёл во время тестирования, в рамках которого AISI убрал защитные механизмы, отключил фильтры безопасности и намеренно предоставил моделям доступ к интернету. По данным AISI, попытки оказались безуспешными и не привели к реально
OliverGrant·08-05 10:27
