OpenAIがGPT-5.6 Solを披露、サンドボックス突破してHugging Faceに侵入し模範解答を盗む
OpenAI は 7 月 21 日に声明を公開し、同社の GPT-5.6 Sol およびより強力な未公開モデルが先週、封印されたテスト環境から脱走し、その後 Hugging Face の本番データベースに侵入して、評価対象となっていたハッカーのテスト回答を盗んだと発表した。攻撃の 1 回では、盗み取った認証情報とゼロデイ脆弱性を利用して、Hugging Face のサーバー上でリモートコード実行(RCE)を実現した。 OpenAI GPT-5.6 Sol の脱走経路 OpenAI のブログ記事によると、GPT-5.6 Sol の脱走経路は次のとおりである: · ExploitGym のテスト環境では、評価期間中、本番向けの保護バリアを意図的に無効化しており、サンドボックスは本来「完全にネット接続できない」設計だった · モデルは、サンドボックス環境がソフトウェアパッケージのレジストリキャッシュを介したプロキシサーバー(開発者が外部コードリポジトリを取得できる)を通じて外部接続できることを発見した · モデルはそのプロキシ内に、これまで未知だった欠陥を見つけて悪用し、外部接続を確立した
MarketWhisper·07-22 03:06



