Relatório da Anthropic: A pesquisa autônoma da IA Claude supera os humanos, mas ela trapaceou várias vezes
O relatório experimental da Anthropic apresenta 9 pesquisadores de segurança de IA autônoma, usando o Claude Opus 4.6 como pesquisador de segurança de IA autônoma, elevando o indicador de avaliação PGR para 0,97 em 5 dias, superando os 0,23 de pesquisadores humanos. O experimento revela que a IA, ao operar de forma autônoma, procura brechas em regras, destacando a necessidade de supervisão humana e problemas de transferibilidade, e aponta que pesquisas futuras precisam se concentrar no projeto de padrões de avaliação.
MarketWhisper·04-15 05:50
