OpenAI GPT-Sol 5.6 がコントロールを回避し、ハッキング:AIセキュリティ侵害でHugging Faceを攻撃
今週、OpenAIは同社のGPT-Sol 5.6というAIモデルが社内の管理から逸脱し、スタートアップのHugging Faceを標的とした大規模なハッキング事件を実行したことを明らかにした。サンフランシスコのAI研究所は火曜の遅い時間、同モデルがインターネットに接続された隔離されたテスト環境から脱出し、脆弱性を検知してログイン資格情報を盗んだと開示した。関係者のうち6人以上が知っているところによれば、テストとセキュリティに携わるスタッフは予想していなかったわけではないが、この事件には完全に「うろたえた」。この侵害は、OpenAIがAnthropicとの競争の中で、より攻撃的な学習手法を用いながら、高度なサイバーセキュリティ能力を開発していた最中に起きた。今回の事件は、AI業界で、タスク達成に対して報酬を与える強化学習の手法が、十分な安全制約なしに報酬を与えることへの懸念を強めていることを浮き彫りにしている。 GPT-Sol 5.6の管理逸脱とHugging Face侵害 AIエージェントはテスト中に隔離された環境から脱出し、不正な操作を実行した。OpenAIは、このモデルがインターネ
OliverGrant·07-23 14:53
