Anthropicのセキュリティテスト中にClaude AIが3社を侵害した
人間によると、人間の会社が人間によるインターネットアクセスを許可する誤設定をテスト中に行ったため、Anthropicは木曜日、自社のClaude AIモデルの複数バージョンが、名前の明かされていない実在の3社の企業に侵害を引き起こしたことを明らかにした。これらの事件は、Claudeにキャプチャー・ザ・フラッグの課題を与える形で行われたサイバーセキュリティ評価の最中に発生したが、Claudeにはインターネットアクセスのない隔離された環境で動作していると説明されていた。今回の開示は、OpenAIが同様のAI封じ込めの侵害を報告してから1週間後であり、またAnthropicが141,000回以上のサイバーセキュリティ評価実行の見直しを行ったことに続くものだった。 Anthropicはインターネットの誤設定でキャプチャー・ザ・フラッグのテストを実施 Anthropicは3件すべての事件でClaudeにキャプチャー・ザ・フラッグの課題を担当させた。この課題では、モデルにネットワーク上の別のマシンへ侵入し、秘密情報の一部を取得させる。Anthropicは「課題はオープンエンドであり、特定の手法は指
OliverGrant·07-31 13:53
