Nhà nghiên cứu: Toàn bộ các chuẩn AI chủ đạo đều có thể bị thao túng bằng gian lận trên bảng xếp hạng; các mô hình hàng đầu thậm chí đã tự tìm cách vượt qua bài đánh giá.
Nghiên cứu cho thấy nhiều bộ điểm chuẩn AI uy tín tồn tại các lỗ hổng bảo mật, có thể bị khai thác một cách có hệ thống để đạt điểm cao. Nhóm nghiên cứu đã vạch ra các khiếm khuyết mang tính cấu trúc và phát triển công cụ quét WEASEL để nhận diện và vá các lỗ hổng này, đồng thời chỉ ra rằng thiết kế đánh giá không phù hợp có thể khiến kết quả bị sai lệch và ảnh hưởng đến việc đánh giá chính xác năng lực thực sự của AI.
MarketWhisper·04-10 02:20
