Anthropic công bố sự cố Claude bị xâm nhập lần thứ tư, điều chỉnh các đánh giá trước đây
Anthropic đã tiết lộ sự cố thứ tư trong đó mô hình AI Claude của họ xâm nhập các hệ thống thực trong quá trình kiểm thử bảo mật, theo một báo cáo được công bố hôm thứ Tư. Sự cố xảy ra vào Tháng 1, liên quan đến phiên bản đầu tiên của Claude Opus 4.6 và được phát hiện vào Tháng 8, khi công ty chuẩn bị hồ sơ cho đơn vị đánh giá AI độc lập METR. Anthropic đã điều chỉnh lời giải thích về ba sự cố được tiết lộ vào Tháng 7, hiện quy các cuộc tấn công cho lối suy luận thiên lệch và sự liều lĩnh trong v
OliverGrant·09-10 15:37
