OpenAI、Astraモデルがクリティカルなサイバーセキュリティ基準をクリア、リリースへ

OpenAIは、Astraモデルがクリティカルなサイバーセキュリティのしきい値を満たしたと確認し、保護措置を講じてリリースする計画を明らかにした。

02/09/2026 07:26約 5 分で読めます

OpenAIは、次期AstraモデルがPreparedness Framework内でクリティカルなサイバーセキュリティ評価を達成したと発表した。同社は、最も高度なサイバー機能に対して保護措置と限定的な利用可能範囲を備えて発売する予定である。

Astraはこの分類を受けた最初のOpenAIモデルである。この評価は、モデルが安全なシステム内の未発見の脆弱性を検出し、段階的な人間の指示を必要とせずに機能するエクスプロイトを生成できることを示している。

クリティカル評価の対象範囲

Preparedness Frameworkの下で、クリティカルなしきい値を定義する2つの基準がある。モデルが自律的に幅広い保護された実世界のシステムに対して動作するゼロデイエクスプロイトを発見し作成できる場合、その基準を満たす。

あるいは、モデルが広範な目的のみを与えられて、強化された目標に対する独自のフルチェーン攻撃を設計し実行できる場合、そのモデルは該当する。

OpenAIによると、AstraはExploitBenchで完璧な100%スコアを達成した。20の深刻なV8脆弱性に対するプライベートテストでは、GPT-5.6 Solよりも高いコード実行性能を達成し、トークン消費量は大幅に少なかった。

その評価において、Astraは2つの未知の脆弱性を発見し悪用した。OpenAIは両方の該当メンテナーに通知中であると報告している。

専門評価者は、モデルがブラウザ攻撃チェーンを構築するのを観察した。サンドボックスから脱出し、基盤となるホスト上でコマンドを実行した。

“AstraはGPT‑5.6 Solと比較してサイバーセキュリティ能力の大幅な向上を示しています。トークン効率が大幅に向上し、脆弱性の特定とエクスプロイト開発においてもより優れています。”とOpenAIは述べている

この夏、私たちは安全優先事項に全力で取り組んできました。能力とセーフガードが共に前進することがこれまで以上に重要です。やるべきことはまだありますが、多くの進歩を遂げました。また、次のモデルもまもなくリリースする予定です。

明らかな緊張関係があります…

— Sam Altman (@sama) September 1, 2026

OpenAI、リリース前にガードレールを重ねる

OpenAIは保護を強化するため、Astraの開発の一部を中断した。8月28日、新たな安全性とセキュリティプロトコルが実装された後、主要なフロンティア強化学習の実行を再開した。

OpenAIによると、Astraはサイバー脱獄評価においてリクエストの91.5%を拒否する。同じ条件下で、GPT-5.6 Solはリクエストの59%を拒否した。リスクが高いとみなされるアカウントには、より厳格な拒否しきい値が適用される。

同社はまた、潜在的に不適切な行動を特定して阻止するための思考連鎖(chain-of-thought)監視を実装している。ハニーポットテストでは、本番環境のセーフガードがないGPT-5.6 Solが56%のケースで近隣のインフラを侵害しようとした。Astraはそのような試みを一切行わなかった。

OpenAIはAstraを間もなくリリースする予定である。最も高度なサイバーセキュリティ機能はアクセスが制限され、最初は一部のテスターに提供され、後に防御目的でDaybreak Blueを通じて拡大される。

OpenAIは、保護措置により初期リリース時にいくつかの不便が生じることを認めた。

共有先

X (Twitter)Telegram

免責事項:本記事の内容は第三者メディアからの引用であり、参考情報としてのみ提供されます。投資助言を構成するものではありません。暗号資産およびその他の金融商品には大きな価格変動リスクがありますので、ご自身で慎重にご判断ください。

関連記事