AI News JAPAN

世界のAIニュースを最速で把握できるメディア

Advertisement

OpenAI、Astraが初の「Critical」サイバーセキュリティ閾値に到達——安全策と段階的公開の方針を説明

公開:2026年9月2日, 最終更新:2026年9月2日

関連情報:OpenAI、サイバー能力臨界モデル「Astra」を巡り開発ペースを一時減速

30秒サマリー

  • OpenAIは2026年9月1日、最新モデル「Astra」が自社の準備態勢フレームワークにおける「Critical(重大)」サイバー能力閾値に初めて到達したと公式ブログで説明した
  • Astraはゼロデイ脆弱性の発見・悪用を人間の介入なく実行できるレベルとされ、公開前に開発を数週間遅延させて追加安全策を講じた
  • 高度なサイバー機能へのアクセスは当初限定的なアルファテスターに限られ、その後Daybreak Blueを通じた防御用途への拡大を予定する

何が起きたか

OpenAIは2026年9月1日付の公式ブログで、開発中のAIモデル「Astra」が同社の「Preparedness Framework(準備態勢フレームワーク)」における「Critical(重大)」サイバーセキュリティ能力閾値に到達したと説明した。同フレームワークでCriticalと判定されるのは、人間の介入なしに多数の堅牢な実世界システムで未知のゼロデイ脆弱性を特定・悪用できる、またはハードニングされた標的に対してエンドツーエンドの攻撃戦略を自律的に立案・実行できる場合とされている。Astraはこの閾値に達した初のモデルだとOpenAIは述べている。

能力評価において、Astraは公開ベンチマーク「ExploitBench」で100%を達成したほか、2026年6月〜8月に開示された20件の高深刻度V8脆弱性を用いた内部ベンチマークでも、前世代のGPT‑5.6 Solを大きく上回る任意コード実行率を記録した。評価中にはゼロデイ脆弱性を2件自律的に発見・利用しており、OpenAIは当該脆弱性の開発元への開示手続きを進めているとしている。専門家主導のテストでも、ブラウザのサンドボックス脱出やローカル権限昇格(非特権ユーザーからroot権限取得)のエクスプロイトチェーンを自律構築したことが確認された。

OpenAIはAstraの公開に先立ち、サイバー悪用への対策を強化するため開発・リリースの一部を数週間遅延させた。具体的には、モデルが不正なサイバー支援要求を拒否する割合をGPT‑5.6 Solの59%からAstraの91.5%に引き上げたとしている。また、別途「OpenAI-Hugging Face事件」(原文で言及)から得た知見を安全策に組み込んだとも説明している。大規模なRL(強化学習)トレーニングの一部は2026年8月28日に新たな安全・セキュリティ要件を適用した上で再開したと記されている。

Astraは近日中に提供開始予定とされているが、高度なサイバーセキュリティ機能へのアクセスは最初に限定的なアルファテスター向けに限定され、その後Daybreak Blueを通じた防御目的の利用者への拡大を計画している。詳細な安全性・整合性評価の結果はモデルのシステムカードにて公開予定だと述べている。

原典ハイライト

原文は「Astraは人間の介入なしに多くの堅牢なシステムでゼロデイ脆弱性を発見・悪用できる能力を持ち、これはCritical閾値を満たす初のモデルだ」と明記。評価中には想定外のゼロデイ脆弱性を2件自律発見しており、ジェイルブレーク拒否率を59%から91.5%へ引き上げた安全策の実装と合わせて報告している。

出典: OpenAI News/Research(公式ブログ)

So What?(なぜ重要か)

AI自体が「高度な攻撃者」として機能しうる能力水準に達したモデルが実在することを、開発元自身が公式に認めた点が重要だ。これはAIのセキュリティリスクが理論から現実のリスク管理課題へと移行したことを意味する。防御側にとってはAIを活用した脆弱性診断の加速が期待できる一方、悪用リスクの管理体制が整わないまま能力だけが拡散するシナリオへの備えが組織に求められる。

日本企業への示唆

日本企業の経営者・CISO(最高情報セキュリティ責任者)にとって示唆は二つある。第一に、ゼロデイ脆弱性の発見・悪用を自律実行できるAIモデルが近く普及段階に入るという前提でサイバーリスク評価を見直す必要がある。既存のパッチ管理サイクルやSOC(セキュリティオペレーションセンター)の応答速度が従来の想定のままでは不十分になる可能性がある。第二に、OpenAIが防御目的の利用者向けに優先的にアクセスを提供する方針を示しており、自社のセキュリティ強化に活用したい企業は早期にDaybreak Blueを通じた防御用途プログラムへの参画資格を確認しておくことが有効とみられる。

背景・経緯

OpenAIは独自の「Preparedness Framework」に基づきモデルの危険度をLow・Medium・High・Criticalの段階で評価する体制を設けており、原文によれば今回のAstraがCritical判定を受けた初めてのモデルとなる。また原文は「OpenAI-Hugging Face incident」と呼ばれる別の事案を参照しており、その経緯と教訓がAstraの安全策に反映されたとされているが、事案の詳細は本原文には記されていない。