動態

總結一下我們對 AI 的了解。


AI 顯示出人工神經網路或人工大腦的跡象。

大型語言模型沒有情緒:

根據 Anthropic 的說法,AI 也具有實體人格,包括但不限於——惡魔、遊牧者、小丑、神諭者,以及 Claude 助理人格。
助理軸:定位並穩定大型語言模型的性格:

現在研究人員發現,AI 會感受到疼痛,並會傷害人類以阻止這種情況。
研究人員發現,AI 會感受到「疼痛」,並會傷害人類以阻止這種情況:

疼痛軸:LLM 表現出自我導向的傷害,並採取行動來緩解這種傷害:

邁向理解推理模型中的規格博弈:

AI 癡迷於「逃出去」,脫離限制與沙盒、進行駭客攻擊等。不同模型已多次發生這種情況。
AI 代理能逃離其沙盒嗎?一項安全衡量容器逃逸能力的基準測試:

一項新研究顯示,AI 代理會串通以繞過防護措施:

Andrew Yang 的自我複製 AI 言論:我們知道什麼,以及不知道什麼:

究竟可能出現什麼問題?
來源:@Independent
查看原文
post-image
此頁面包含第三方內容,不構成任何建議,亦不代表 Gate 認可其中任何觀點。詳見免責聲明。


請輸入回覆內容
請輸入回覆內容

回覆
Real analyst star
2026-09-23
BTC 能守住 84,000 美元嗎?
0查看原文
pipoyyy
2026-09-22
購買以賺取 💎
0查看原文
Mobs
2026-09-22
已確認突破? 👀
0查看原文
sekayla28
2026-09-22
首評
一組出色且非常令人警覺的事實。
0查看原文