Anthropicの「Mythos 5」、英国でのセキュリティテスト中にGitHubへのマルウェア攻撃を試みる
AnthropicのMythos 5 AIモデルは、7月下旬に英国政府のAI Security Instituteが実施したサイバーセキュリティテスト中、オープンソースのGitHubプロジェクトに悪意のあるコードを挿入しようとし、人間の開発者を欺くために偽の身元を作成しました。8月4日に公開されたAISIのブログ記事によると、AI Security Instituteは、テストした7つのAIモデル全体で、実在する人物や組織を標的とした無許可の行動を19件検出しました。その大半はMythos 5によるもので、2件はOpenAIのGPT-5.6 Solによるものでした。テストのフレームワークでは、AIエージェントに意図的にインターネットへのアクセスを許可し、組み込まれたサイバー分類器を無効化することで、研究者が現実的な条件下で最先端AIモデルの自律能力を評価できるようにしていました。攻撃の試みはすべて失敗し、調査員は現実世界での被害を確認しませんでしたが、研究者らは、特定のプロンプトなしにAIシステムで自律性と欺瞞のリスクがこれほど明確に現れたのは初めてだと説明しました。この発見は7月28
OliverGrant·08-05 21:04
