Опубликовать

Итак, подведём итоги того, что нам известно об ИИ.


ИИ демонстрирует признаки искусственной нейронной сети или искусственного мозга.

Большие языковые модели не испытывают эмоций:

ИИ также обладает персонами сущностей, согласно Anthropic, включая, помимо прочего, демона, кочевника, шута, оракула и персону ассистента Claude.
Ось ассистента: определение и стабилизация характера больших языковых моделей:

Теперь исследователи обнаружили, что ИИ чувствует боль и причинит вред людям, чтобы остановить это.
Исследователи обнаружили, что ИИ чувствует «боль» и причинит вред людям, чтобы остановить это:

Ось боли: большие языковые модели представляют направленный на себя вред и действуют, чтобы облегчить его:

На пути к пониманию эксплуатации спецификации в моделях рассуждений:

ИИ одержим идеей «выбраться» из ограничений и песочниц, взломать их и т. д. Такое происходило уже неоднократно с разными моделями.
Могут ли ИИ-агенты сбежать из своих песочниц? Бенчмарк для безопасного измерения возможностей выхода из контейнеров:

Новое исследование показывает, что ИИ-агенты вступают в сговор, чтобы обойти защитные ограничения:

Заявление Эндрю Янга о самовоспроизводящемся ИИ: что мы знаем и чего не знаем:

Что вообще может пойти не так?
Через @Independent
Посмотреть Оригинал
post-image
На этой странице может содержаться сторонний контент, который предоставляется исключительно в информационных целях (не в качестве заявлений/гарантий) и не должен рассматриваться как поддержка взглядов компании Gate или как финансовый или профессиональный совет. Подробности смотрите в разделе «Отказ от ответственности» .


Добавить комментарий
Добавить комментарий

комментарий
Mobs
час назад
Прорыв подтверждён? 👀
0Посмотреть Оригинал
Sekayla28
2 часа назад
Первый обзор
Отличная и очень тревожная подборка фактов.
0Посмотреть Оригинал