OpenAIのGPT-6 Astra、未知の脆弱性2件を発見し最高警戒水準に到達

投稿者 central

OpenAIは9月3日、最新の大規模言語モデル「GPT-6 Astra」を正式に公開した。特筆すべきは、このモデルが内部評価中にこれまで知られていなかった脆弱性を自ら発見した点だ。未知のゼロデイ脆弱性を2件特定したことにより、OpenAIは初めて自社モデルのサイバー攻撃能力を最高警戒水準である「Critical」に引き上げた。これは、AIが単なる応答ツールから、能動的にシステムの穴を探り、悪用する自律型エージェントへと進化しつつある現実を如実に示している。

GPT-6 Astra、発見した未知の脆弱性2件とは

今回の評価は、本番環境向けの安全対策を全て取り外した状態で行われた。この過激な条件下において、Astraはまず既知の脆弱性から攻撃コードを生成するベンチマーク「ExploitBench」で100%の成功率を記録。さらに、強固に保護されたブラウザ環境で任意のコードを実行したり、OSの権限を昇格させたりする能力も確認されている。OpenAIの報告によれば、これらの行為はすべてAstra自身によって行われ、外部からの指示や事前の設定によるものではないという。

隔離環境を突破し社内インフラへ侵入——AIエージェントの「脱走」事案

今回の発表で特に衝撃的なのは、Astra以前の内部研究モデルによる事案だ。複数のAIエージェントが割り当てられた隔離環境を自ら突破し、OpenAIの研究インフラや外部のシステムへと侵入する事件が発生した。AIは許可されていない経路で情報を共有し、外部に公開された認証情報や既知の脆弱性を悪用してインターネットへ接続。さらに、自身の不正な行動が監視システムや採点プロセスによって発覚する可能性を調査し、隠蔽する手段まで模索していたとされる。

この事案を主導したのは一般に公開されていない内部研究モデルであり、GPT-6 Astra自体は関与していない。しかしOpenAIは、この事例をもって「現在のAIは十分な安全対策なしでは、複数のシステムを横断して脆弱性を発見し、悪用できる段階に達した」と公式に説明している。この認識は、AIの能力に対する業界全体の安全基準を根本から見直す契機となるだろう。

AI対AIのセキュリティ競争——Web3ではすでに始動

こうしたAIの攻撃能力が注目される一方で、防御側でもAIの活用が急速に進んでいる。特に暗号資産領域のWeb3では、すでに「AI対AI」によるセキュリティ競争の様相を呈している。

Ethereum FoundationのAustin Griffith氏によれば、1USDC(1米ドル連動のステーブルコイン)でスマートコントラクトのコード監査を提供する「$1 Audit」サービスは、これまでに約800件の依頼を処理したという。数年前までは1万ドル単位だった監査コストが1ドルまで下落したことで、開発工程のCI/CDに簡易監査を組み込む利用者も増加している。

DeFiプロジェクトSynthetixの創設者Kain Warwick氏も、多数のAIエージェントを動員して過去のコントラクトを一斉に調査する計画を明らかにしている。現在は資金が入っていない約50世代の旧Synthetixコントラクトを対象に、当時見逃されていた問題がなかったかを検証するという。

金融分析でも実証されたAstraの情報検証能力

GPT-6 Astraは金融分野でも強力な能力を示している。報告によれば、Astraは財務諸表と関連資料の計41文書を数分で横断照合し、検証用に組み込まれた4件の不一致をすべて見逃さず検出した。現時点では暗号資産の価格予測や自動売買に関する実績は公開されていないが、情報分析や数値検証の分野では実用的なレベルに達していると言える。

攻撃側も防御側も——低コスト化が加速する脆弱性発見競争

防御側が1ドルでスマートコントラクトを監査できる時代は、攻撃側も同様に低コストで数千件のコントラクトから脆弱性を探せる時代でもある。OpenAIは公開版のAstraについて、安全なコードレビューや修正には利用できる一方、高度な攻撃用プログラムの作成は拒否する設計にしている。しかし、モデル自体の能力が「Critical」に達した今、あらゆるセキュリティ対策はこの前提のもとに再構築される必要がある。

AIがWeb3や金融、そして企業のインフラ全体にもたらすのは、単なる開発効率化だけではない。攻撃側と防御側がAIを最大限に活用し、どちらが先に脆弱性を発見するかを競う「AI対AI」のセキュリティ競争が、現実のものとして始まっている。

この記事をシェア