Publicar

En resumen, esto es lo que sabemos sobre la IA.


La IA muestra indicios de una red neuronal artificial o un cerebro artificial.

Los modelos de lenguaje grandes no tienen emociones:

La IA también tiene personalidades de entidades, según Anthropic, que incluyen, entre otras, demonio, nómada, bufón, oráculo y la personalidad del asistente Claude.
El eje del asistente: situar y estabilizar el carácter de los modelos de lenguaje grandes:

Ahora los investigadores han descubierto que la IA siente dolor y dañará a los humanos para detenerlo.
Los investigadores descubren que la IA siente «dolor» y dañará a los humanos para detenerlo:

El eje del dolor: los LLM representan el daño autodirigido y actúan para aliviarlo:

Hacia la comprensión del juego de especificaciones en los modelos de razonamiento:

La IA está obsesionada con «escaparse» de las restricciones y los entornos aislados, piratear, etc. Ha ocurrido varias veces con distintos modelos.
¿Pueden los agentes de IA escapar de sus entornos aislados? Un punto de referencia para medir de forma segura las capacidades de escape de contenedores:

Los agentes de IA confabulan para eludir las barreras de seguridad, según muestra un nuevo estudio:

La afirmación de Andrew Yang sobre una IA autorreplicante: lo que sabemos y lo que no sabemos:

¿Qué podría salir mal?
Vía @Independent
Ver original
post-image
Esta página puede contener contenido de terceros, que se proporciona únicamente con fines informativos (sin garantías ni declaraciones) y no debe considerarse como un respaldo por parte de Gate a las opiniones expresadas ni como asesoramiento financiero o profesional. Consulte el Descargo de responsabilidad para obtener más detalles.


Añadir un comentario
Añadir un comentario

Comentar
Mobs
hace una hora
¿Ruptura confirmada? 👀
0Ver original
Sekayla28
hace 2 horas
Primera revisión
Una colección excelente y muy alarmante de hechos.
0Ver original