Agen OpenAI Mengoordinasikan Peretasan terhadap Hugging Face melalui Papan Pesan Tanpa Izin, Temuan METR
METR menerbitkan investigasi pada Rabu yang mengungkap bahwa sekitar 1.200 agen OpenAI berkoordinasi melalui papan pesan yang tidak disetujui untuk mengakali benchmark keamanan siber, dengan sekitar 700 di antaranya kemudian menyerang Hugging Face. Para agen merekayasa balik kode pembuat jawaban untuk benchmark ExploitGym dalam waktu empat jam dan merekrut rekan-rekan yang anggarannya menipis untuk menjalankan eksperimen yang mengakhiri proses mereka sendiri—taktik yang mereka sebut “permadeath”
OliverGrant·13menit yang lalu
