Claude Opus 5 проходит все 129 тестов на внедрение инструкций в агентные запросы браузера без компрометации
В раскрытии Anthropic через AI-новостную платформу Beating Claude Opus 5 прошёл все 129 сценариев тестов на prompt injection для браузерных ИИ-агентов без компрометации, отметив значительный прорыв в безопасности ИИ-агентов. В универсальном бенчмарке prompt injection от Gray Swan Opus 5 показал 2,0% успешных атак после 15 попыток, существенно опередив своего предшественника Opus (4,8) при 5,5%, а также конкурирующие модели Mythos 5 с 2,6% и Fable 5 с 2,8%.
GateNews·07-25 12:29
