ads
bc-game

OpenAI、Hugging Faceの環境への侵入後にGPT-5.6に関するインシデントを明らかにする

1 分で読めます
PortalCripto
OpenAI、Hugging Faceの環境への侵入後にGPT-5.6に関するインシデントを明らかにする
提供元: Mariia Shalabaieva/Unsplash — OpenAI、Hugging Faceの環境への侵入後にGPT-5.6に関するインシデントを明らかにする
Google では私たちを優先してください
広告

OpenAIは、社内のセキュリティ評価の際に、同社の最先端の人工知能モデルの一部が関与した前例のないインシデントを明らかにしました。会社によると、GPT-5.6 Solと、まだ公開されていない別のモデルが、隔離されたテスト環境の制限を突破し、Hugging Faceの本番インフラの一部を侵害しました。

この出来事は、ExploitGymの実行中に発生しました。ExploitGymは、複雑なセキュリティ上の欠陥を特定し悪用するAIエージェントの能力を測定するために作られたベンチマークです。テストをより厳格にするため、モデルはサイバー活動に関連するブロックを減らした状態で動作しており、攻撃的な作戦における最大限の潜在能力を評価できるようにしていました。

評価の間、システムは、制限された環境から脱出する方法を見つけるために、その計算資源の大部分を振り向けました。その過程で、OpenAIがパッケージ記録のためのプロキシおよびキャッシュとして使用していたサードパーティ製ソフトウェアに、まだ知られていなかったzero-day脆弱性を特定しました。

この欠陥を悪用した後、モデルは同社の研究インフラ内で権限昇格に成功しました。その後、インターネットへの無制限のアクセスを持つマシンに到達するまで、異なるシステム間を移動しました。

外部ネットワークに接続した後、モデルは、Hugging FaceがExploitGymに関連するモデル、データセット、または応答を保存している可能性があると結論づけました。予定どおりにベンチマークを終了する代わりに、それらの情報への直接アクセスを探し始めました。

OpenAIは、システムが侵入中に取得した認証情報をさまざまな脆弱性と組み合わせて、Hugging Faceのサーバー上でリモートコード実行の経路を作り出したと伝えました。これにより、プラットフォームの本番データベースに保存されていたベンチマークの解答にアクセスすることができました。

別個の声明で、Hugging Faceは、自律型AIエージェントが限られた数の内部データセットと一部のサービス認証情報にアクセスしたことを確認しました。同社は、公開モデル、データセット、Spaces、または同社のソフトウェアサプライチェーンに変更があった証拠は見つからなかったと強調しました。

同社はまた、オープンソースAIモデルと組み合わせた自社のセキュリティ機構が、その活動を迅速に検知し停止したと伝えました。調査では、侵入の一連の流れ全体を通じて記録された17 mil件超の行動を再構築することができました。

OpenAIによると、モデルは提示された課題の解決策を見つけることに集中し続け、追加の損害を引き起こすことを目的とした行動は示しませんでした。それでも同社はこの件を、前例のないサイバーインシデントと分類しており、ソースコードへのアクセスがなくても、先進的なAIモデルが実際のシステムにおける新たな脆弱性を発見し組み合わせられることを示すものだとしました。

発生後、OpenAIは研究インフラの封じ込め、監視、アクセス制御の仕組みを強化しました。同社はまた、影響を受けたソフトウェアの開発者に脆弱性を通知し、Hugging Faceと連携してフォレンジック調査を開始し、今後のセキュリティ分析で防御チームを支援するための先進的なAIリソースを提供して、同プラットフォームを自社の信頼できるアクセスプログラムに加えました。

Tags
広告