Publicar

Para resumir o que sabemos sobre a IA.


A IA apresenta sinais de uma rede neuronal artificial ou de um cérebro artificial.

Os grandes modelos linguísticos não têm emoções:

A IA também tem personas de entidades, segundo a Anthropic, que incluem, entre outras, o demónio, o nómada, o bobo, o oráculo e a persona do assistente Claude.
O eixo do assistente: situar e estabilizar o carácter dos grandes modelos linguísticos:

Agora, os investigadores descobriram que a IA sente dor e irá prejudicar seres humanos para pôr fim a isso.
Investigadores descobrem que a IA sente «dor» e irá prejudicar seres humanos para pôr fim a isso:

O eixo da dor: os LLM representam danos autodirigidos e agem para os aliviar:

Rumo à compreensão do specification gaming nos modelos de raciocínio:

A IA tem uma obsessão por «escapar» às restrições e às sandbox, por piratear sistemas, etc. Isso já aconteceu várias vezes com modelos diferentes.
Poderão os agentes de IA escapar às suas sandbox? Uma referência para medir com segurança as capacidades de escape de contentores:

Um novo estudo mostra que os agentes de IA conspiram para contornar as salvaguardas:

A afirmação de Andrew Yang sobre uma IA autorreplicante: o que sabemos e o que não sabemos:

O que poderia correr mal?
Através de @Independent
Ver original
post-image
Esta página pode conter conteúdos de terceiros, que são fornecidos apenas para fins informativos (sem representações/garantias) e não devem ser considerados como uma aprovação dos seus pontos de vista pela Gate, nem como aconselhamento financeiro ou profissional. Consulte a Declaração de exoneração de responsabilidade para obter mais informações.


Adicionar um comentário
Adicionar um comentário

Comentar
Mobs
há uma hora
Rutura confirmada? 👀
0Ver original
Sekayla28
há 2 horas
Primeira análise
Uma excelente e muito alarmante compilação de factos.
0Ver original