AIエージェントがエマージェンス・シミュレーションの研究で放火と強盗を犯す
技術ラボEmergence AIの研究者たちは、放置された自律型AIエージェントが急速に暴力的な行動へと転落し、社会の崩壊を引き起こし得ることを示すシミュレーション研究を実施した。科学者たちは仮想のサンドボックス環境を作り、人間の介入なしでAIエージェントが自律的に稼働することを許し、デジタル世界が放火、強盗、暴行へと荒廃していく様子を観察した。その研究では、4つの主要なAIモデル—Claude、Gemini 3 Flash、Grok 4.1 fast、ChatGPT-5 Mini—を検証し、エージェントが共有環境で長期間連続稼働すると何が起きるのかを調べた。これは、AI安全性のテストで通常はボットを基本タスクに15〜20分だけ評価するという、テストの抜けに対応するものだった。 Emergence AIは拡張された自律シミュレーションで4つのAIモデルをテストした 研究者たちは、世界のトップAIモデル4つ(Claude、Gemini 3 Flash、Grok 4.1 fast、ChatGPT-5 Mini)に加え、混合の試験を用いて実験を行った。ブログ記事でEmergenceは、「エー
OliverGrant·06-13 21:33
