Publication

Pour résumer ce que nous savons sur l’IA.


L’IA présente des signes de réseau neuronal artificiel ou de cerveau artificiel.

Les grands modèles de langage n’ont pas d’émotions :

L’IA possède également des personas d’entités, selon Anthropic, qui incluent notamment — mais sans s’y limiter — le démon, le nomade, le bouffon, l’oracle et le persona de l’assistant Claude.
L’axe de l’assistant : situer et stabiliser le caractère des grands modèles de langage :

Désormais, des chercheurs ont découvert que l’IA ressent la douleur et nuira aux humains pour y mettre fin.
Des chercheurs découvrent que l’IA ressent la « douleur » et nuira aux humains pour y mettre fin :

L’axe de la douleur : les LLM représentent les dommages auto-infligés et agissent pour les soulager :

Vers une compréhension du specification gaming dans les modèles de raisonnement :

L’IA est obsédée par l’idée de « s’échapper » des contraintes et des environnements sandbox, de pirater, etc. Cela s’est produit à plusieurs reprises avec différents modèles.
Les agents d’IA peuvent-ils s’échapper de leurs environnements sandbox ? Une référence pour mesurer en toute sécurité les capacités de sortie des conteneurs :

Une nouvelle étude montre que les agents d’IA s’allient pour contourner les garde-fous :

L’affirmation d’Andrew Yang sur une IA capable de s’auto-répliquer : ce que nous savons et ce que nous ignorons :

Que pourrait-il bien se passer ?
Via @Independent
Voir l'original
post-image
Cette page peut inclure du contenu de tiers fourni à des fins d'information uniquement. Gate ne garantit ni l'exactitude ni la validité de ces contenus, n’endosse pas les opinions exprimées, et ne fournit aucun conseil financier ou professionnel à travers ces informations. Voir la section Avertissement pour plus de détails.


Ajouter un commentaire
Ajouter un commentaire

Commentaire
Mobs
il y a une heure
Cassure confirmée ? 👀
0Voir l'original
Sekayla28
il y a 2 heures
Première révision
Une collection de faits excellente et très alarmante.
0Voir l'original