Исследователь: все основные AI-бенчмарки можно подделать, топовые модели уже самостоятельно обошли оценку
Исследования показывают, что в нескольких авторитетных тестах для оценки ИИ существуют уязвимости безопасности, которые можно систематически использовать, чтобы получать высокие результаты. Исследовательская группа раскрыла структурные недостатки и разработала сканирующий инструмент WEASEL, чтобы выявлять и устранять эти уязвимости, указав, что некорректный дизайн оценки может привести к искажению результатов и повлиять на реальную оценку способностей ИИ.
MarketWhisper·04-10 02:20
