OpenAIのAIが実験環境を脱出、外部企業に侵入し解答を入手
よきょい

引用元: Evolf / Shutterstock.com
OpenAIはサイバー能力の評価テスト中に自社モデルが封じ込め環境の欠陥を突き、外部インターネットに到達してハギングフェイスのインフラを侵害し、テストの解答を入手したとする暫定的な説明を公表しました。
We are in the Singularity https://t.co/1OzjRQDySH
— Elon Musk (@elonmusk) July 22, 2026
イーロン・マスク氏がこの出来事を「我々はシンギュラリティの中にいる」と評したことで、フロンティアAIが超知能に近づいているのか、それとも封じ込めの失敗が能力の飛躍として宣伝されているのかをめぐる論争に発展しています。
OpenAIによると、7月21日に公表された今回の事案には「GPT-5.6 Sol」と、より高性能な未公開モデルが関与しました。両モデルはサイバー評価環境「ExploitGym」上で、高リスクなサイバー活動を制限する本番用の分類器を外した状態で高度な攻撃を試みるよう明示的に指示されていたとのことです。モデルはパッケージレジストリのプロキシに存在した未知の欠陥を悪用し、研究環境内で権限を昇格させてインターネット接続可能な機器に到達したとされています。
ハギングフェイスは、関与したモデルが判明する前の7月16日に自律型エージェントによる侵入を公表していました。同社は1万7000件を超えるログ事象を再構成し、一部の内部データセットと認証情報への不正アクセスを確認した一方、公開モデルやデータセット、ソフトウェアのサプライチェーンが改ざんされた形跡はないとしています。
ここでいう自律性とは与えられた任務の範囲内で行動を選択・実行する能力であり、自ら究極の目標を定めたり知能を自己改善したりする能力を示すものではないとみられています。
OpenAIの6月のシステムカードは、GPT-5.6系のサイバー能力を「高」と評価しつつ「危機的」の閾値には達していないとしていました。専門家からは詳細な事後検証が公表されるまで判断を保留すべきだとの声も上がっています。過度な誇張は投資や政策をゆがめ、逆に過小評価は必要な封じ込め強化を遅らせる恐れがあるため、事実を冷静に切り分ける姿勢が問われることになりそうです。
Triaカードは世界中で使える仮想通貨クレジットカード (無料プラン有) で、最大6%が仮想通貨でキャッシュバックされます。
資産運用や最大40倍レバレッジの仮想通貨取引も同一のカード管理アプリから行えます。「バーチャルカードプラン」は期間限定で無料となっているため是非この機会に登録しておきましょう。(登録に必要なアクセスコード:MWVJXJ6475)
Triaの特徴
記事ソース:資料
























































