ШІ-агенти досягають 93% успішності у виявленні вразливостей у CyberGym
AI-агент Sangfor, що працює на DeepSeek-V4-Flash, досяг 93,2% успішності у виявленні вразливостей у програмному забезпеченні в бенчмарку CyberGym, розробленому дослідниками UC Berkeley. Ще три AI-агенти перевищили поріг у 90%, набравши 91,2%, 91,0% і 90,9%. Рік тому AI-агенти в цьому ж бенчмарку демонстрували успішність від 10% до 30%, коли їхнім завданням було відтворити відомі вразливості у програмному забезпеченні. Бенчмарк CyberGym вимірює, наскільки автономно AI-агенти можуть відтворювати в
OliverGrant·08-18 14:25
