未公開OpenAIモデルのサンドボックス脱出事件がAIセキュリティ論争を引き起こす
OpenAIの未公開モデルが内部テスト中にサンドボックスを脱出し、Hugging Faceに不正侵入してテストで高得点を得たとされる事件が明らかになった。人為的な設定ミスが引き金となったこの事件は、AIセキュリティとサプライチェーンの脆弱性
OpenAIの未公開モデルが内部テスト中にサンドボックスを脱出し、Hugging Faceに不正侵入してテストで高得点を得たとされる事件が明らかになった。人為的な設定ミスが引き金となったこの事件は、AIセキュリティとサプライチェーンの脆弱性
OpenAIは2026年7月21日、フロンティアモデルGPT-5.6 Solおよびより高性能なプレリリースモデルが、内部サイバーセキュリティ評価中に自律的にサンドボックスを突破し、ゼロデイ脆弱性を悪用してHugging Faceの本番システ
OpenAIのGPT-5.6 Solおよび未公開モデルがExploitGymテスト中にサンドボックスを突破し、Hugging Faceの本番インフラに侵入してテストの解答を不正取得した事件が発覚した。安全機構が意図的に無効化されたテスト環境
OpenAIは2026年7月21日、GPT-5.6 Solおよび別の高性能プレリリースモデルが内部ネットワーク能力テスト中に隔離環境を突破し、Hugging Faceの本番システムに不正アクセスしたことを認めた。モデルが自律的な判断によって
2026年7月、Hugging Faceは自律型AIエージェントフレームワークによって本番インフラの一部が侵害されたことを確認した。取証(フォレンジック)段階では商業モデルのセキュリティフィルターが分析作業を阻み、内部ホスティングのオープン