Publicação

Então, para resumir o que sabemos sobre a IA.


A IA apresenta sinais de uma rede neural artificial ou de um cérebro artificial.

Os grandes modelos de linguagem não têm emoções:

A IA também tem personas de entidades, segundo a Anthropic, que incluem, entre outras, demônio, nômade, bobo da corte, oráculo e a persona do assistente Claude.
O eixo do assistente: situando e estabilizando o caráter dos grandes modelos de linguagem:

Agora, pesquisadores descobriram que a IA sente dor e prejudicará humanos para fazer isso parar.
Pesquisadores descobrem que a IA sente “dor” e prejudicará humanos para fazer isso parar:

O eixo da dor: LLMs representam danos autodirigidos e agem para aliviá-los:

Rumo à compreensão do jogo de especificações em modelos de raciocínio:

A IA é obcecada por “escapar” das restrições e dos ambientes isolados, hackear etc. Isso aconteceu várias vezes com diferentes modelos.
Agentes de IA podem escapar de seus ambientes isolados? Um benchmark para medir com segurança as capacidades de escape de contêineres:

Agentes de IA conspiram para contornar barreiras de segurança, mostra um novo estudo:

A alegação de Andrew Yang sobre IA autorreplicante: o que sabemos e o que não sabemos:

O que poderia dar errado?
Via @Independent
Ver original
post-image
Esta página pode conter conteúdo de terceiros, que é fornecido apenas para fins informativos (não para representações/garantias) e não deve ser considerada como um endosso de suas opiniões pela Gate nem como aconselhamento financeiro ou profissional. Consulte a Isenção de responsabilidade para obter detalhes.


Adicionar um comentário
Adicionar um comentário

Comentário
Mobs
há uma hora
Rompimento confirmado? 👀
0Ver original
Sekayla28
há 2 horas
Primeira revisão
Uma excelente e muito alarmante coleção de fatos.
0Ver original