Claude Opus 5 проходить усі 129 тестів на ін’єкцію підказок у браузерних агентів без компромісів
Згідно з розкриттям Anthropic через платформу AI-новин Beating, Claude Opus 5 пройшов усі 129 сценаріїв тестів на prompt injection для браузерних агентів без жодних компромісів, що стало значним проривом у безпеці AI-агентів. У універсальному бенчмарку prompt injection від Gray Swan під час тестування Opus 5 зафіксовано 2,0% частки успішних атак після 15 спроб, що суттєво випередило його попередника Opus 4 (5,5%), а також конкуруючі моделі Mythos 5 (2,6%) і Fable 5 (2,8%).
GateNews·07-25 12:29
