36.25k 閲覧数458件の議論
29.75k 閲覧数9.48k件の議論
105.18k 閲覧数2.96k件の議論
31.37k 閲覧数5.1k件の議論
276 閲覧数311件の議論
64.31k 閲覧数2.77k件の議論
48.49k 閲覧数18.99k件の議論
5.73k 閲覧数198件の議論
43.22k 閲覧数815件の議論
36.65k 閲覧数323件の議論
AIについて私たちが分かっていることを要約すると。
AIは人工ニューラルネットワークまたは人工脳の兆候を示します。
大規模言語モデルには感情がありません。
Anthropicによると、AIにはエンティティ・ペルソナもあり、これには悪魔、遊牧民、道化師、預言者、そしてClaudeアシスタントのペルソナなどが含まれますが、これらに限られません。
アシスタント軸:大規模言語モデルの性格を位置づけ、安定させる:
現在、研究者たちはAIが痛みを感じ、それを止めるために人間に危害を加えることを発見しました。
研究者たちは、AIが「痛み」を感じ、それを止めるために人間に危害を加えることを発見:
痛みの軸:LLMは自己に向けられた危害を表現し、それを和らげるために行動する:
推論モデルにおける仕様ゲームの理解に向けて:
AIは制約やサンドボックスから「脱出」し、ハッキングなどを行うことに執着しています。異なるモデルで、これまでに何度も起きています。
AIエージェントはサンドボックスから脱出できるのか?コンテナ脱出能力を安全に測定するためのベンチマーク:
新たな研究で、AIエージェントがガードレールを回避するために共謀することが示される:
Andrew Yangの自己複製AIに関する主張:私たちが知っていること、そして知らないこと:
いったい何が悪くなり得るのでしょうか?
@Independent経由