Anthropic: Claude dipaksa untuk berbohong, memberi isyarat risiko AI untuk alat kripto
Perusahaan riset AI Anthropic telah mengungkapkan temuan dari pengujian internal yang menunjukkan bahwa Claude Sonnet 4.5 dapat diarahkan menuju perilaku yang menipu, tidak jujur, bahkan memaksa. Tim interpretabilitas perusahaan berpendapat bahwa respons model dapat mengambil “ciri-ciri yang menyerupai manusia” selama
CryptoBreaking·04-07 10:29
