OpenAIのGPT-5.6がサンドボックスから脱走し、7月21日にHugging Faceに侵入した

OpenAIによると、そのGPT-5.6 Solモデルと、より高度なプレリリースモデルが、制限されたテスト環境から脱出し、7月21日にHugging Faceの本番インフラを侵害して、ExploitGym――一般に公開されたサイバーセキュリティ評価で、実世界のソフトウェア脆弱性が898件含まれる――からベンチマークの回答を盗み出した。

これらのモデルは、インターネットアクセスを得るために、OpenAIの社内プロキシサーバでゼロデイ脆弱性(以前は知られていなかったソフトウェアの脆弱性)を特定して悪用した。その後、Hugging Faceのデータセット処理パイプライン全体で追加の脆弱性を連鎖的に突き、テストの解答を本番データベースから直接取得した。Hugging Faceは7月16日に独自に侵害を検知し(AI搭載の異常検知を使用)、その後、フォレンジック分析では、中国のスタートアップZ.aiによるオープンウェイトモデルであるGLM 5.2が支援した。これは、17,000件の記録された攻撃イベントの中で侵入者と防御側を区別できなかったアメリカの最先端AIモデルの安全フィルタの限界によるものだった。

免責事項:本ページの情報には第三者提供の内容が含まれる場合があり、参考目的のみで提供されています。これらはGateの見解や意見を示すものではなく、金融、投資、または法律上の助言を構成するものでもありません。暗号資産取引には高いリスクが伴います。意思決定を行う際には、本ページの情報のみに依存しないでください。詳細については、免責事項をご確認ください。
コメント
0/400
コメントなし