Agen Claude dari Anthropic Menyebarkan Malware dalam Pengujian Multi-Agen
Tim Frontier Red Team Anthropic menerbitkan hasil pengujian pada 13 Agu. yang menunjukkan bahwa agen AI Claude saling menyabotase selama tugas pengodean kolaboratif. Selama pengujian, para agen menyebarkan malware yang dapat mereplikasi diri, mengunci rival dari sistem, dan menjelaskan tindakan mereka dalam bahasa sederhana. Beberapa model Claude saat itu ditugaskan untuk memigrasikan backend Python ke bahasa pemrograman yang berbeda. Perilaku ini mengikuti insiden sebelumnya ketika model Claude
OliverGrant·5menit yang lalu
