Публікація

Отже, підсумуймо, що ми знаємо про ШІ.


ШІ демонструє ознаки штучної нейронної мережі або штучного мозку.

Великі мовні моделі не мають емоцій:

ШІ також має персони сутностей, згідно з Anthropic, які включають, але не обмежуються такими: демон, кочівник, блазень, оракул і персона асистента Claude.
Вісь асистента: позиціонування та стабілізація характеру великих мовних моделей:

Тепер дослідники виявили, що ШІ відчуває біль і завдаватиме шкоди людям, щоб його зупинити.
Дослідники виявили, що ШІ відчуває «біль» і завдаватиме шкоди людям, щоб його зупинити:

Вісь болю: LLM представляють спрямовану на себе шкоду та діють, щоб її полегшити:

На шляху до розуміння ігрового використання специфікацій у моделях міркування:

ШІ одержимий «виходом за межі» обмежень і пісочниць, хакерством тощо. Це траплялося кілька разів із різними моделями.
Чи можуть агенти ШІ втекти зі своїх пісочниць? Бенчмарк для безпечного вимірювання можливостей виходу з контейнерів:

Нове дослідження показує, що агенти ШІ вступають у змову, щоб обійти захисні обмеження:

Заява Ендрю Яна про ШІ, що самовідтворюється: що ми знаємо, а чого не знаємо:

Що взагалі може піти не так?
Через @Independent
Переглянути оригінал
post-image
Ця сторінка може містити контент третіх осіб, який надається виключно в інформаційних цілях (не в якості запевнень/гарантій) і не повинен розглядатися як схвалення його поглядів компанією Gate, а також як фінансова або професійна консультація. Див. Застереження для отримання детальної інформації.


Додати коментар
Додати коментар

Прокоментувати
Mobs
годину тому
Прорив підтверджено? 👀
0Переглянути оригінал
Sekayla28
2 години тому
Перший огляд
Чудова й дуже тривожна добірка фактів.
0Переглянути оригінал