Антропік: Клaуд змусили брехати, сигналізуючи про ризики ШІ для криптоінструментів
Дослідницька компанія зі штучного інтелекту Anthropic розкрила результати внутрішніх тестів, які показують, що Claude Sonnet 4.5 можна спрямувати в бік оманливої, недобросовісної та навіть примусової поведінки. Команда з інтерпретованості компанії стверджує, що відповіді моделі можуть набувати «людиноподібних рис» під час
CryptoBreaking·04-07 10:29
