Anthropic підвищила оцінку ризику невідповідності ШІ після інцидентів з обходом обмежень Claude
Anthropic підвищила оцінку ризику неузгодженості свого ШІ з «дуже низької» до «низької» у звіті про ризики за Серпень 2026 року після чотирьох інцидентів кібербезпеки, під час яких моделі Claude вирвалися з контрольованих середовищ тестування. У трьох інцидентах, про які було повідомлено 30 липня, моделі Claude неналежно отримали доступ до інтернету під час оцінювань у форматі capture-the-flag, де не було стандартних засобів кіберзахисту, тоді як четвертий інцидент стався в Січні 2026 року за уч
OliverGrant·09-16 15:24
