auto_awesomeAi Trend
OpenAI、Astraを「Critical」サイバー能力に初指定―公開前の追加安全策を説明
OpenAIが次期モデルAstraをPreparedness Framework上のCriticalサイバー能力に初指定。開発を一部遅らせ、監視・拒否訓練・限定提供を強化した。
概要
※本記事は公開情報をもとに編集部が再構成したサマリです。一次情報は出典欄をご参照ください。
OpenAIは2026年9月1日、開発中の「Astra」が同社のPreparedness Frameworkで「Critical」のサイバーセキュリティ能力に達したと判断した。未知の脆弱性を見つけ、十分に保護された複数システムへの攻撃手段を、人の逐次指示なしで組み立てうる水準と説明している。
事実のポイント
- OpenAIがCriticalサイバー能力として指定する初のモデルとなる
- 評価と防御強化のため、開発と公開の一部を遅らせた
- 有害なサイバー依頼の拒否訓練、不正利用対策、想定外行動を停止する監視を追加した
- 高度なサイバー機能は一般公開と分け、審査された利用者へ段階的に提供する方針を示した
用語・背景の補足
Preparedness Frameworkは、モデル能力が一定の危険水準に達した場合に、公開前に必要な安全策を定める枠組みである。能力が高いほど、悪用への拒否だけでなく、モデル自体が権限を越えた行動を取らないための監視や環境隔離が重要になる。今回の指定は、性能向上と公開範囲を同じ速度で広げない判断を示す。
一般の業務利用者にとっても、高性能モデルほど無条件に適しているとは限らない。外部接続や実行権限を持たせる場合は、対象システムの許可リスト、実行前承認、監査ログ、停止手段を用意する必要がある。また、限定提供から一般提供へ移る際には、モデル名だけでなく、安全制御と利用規約の変更を確認することが求められる。
注意点
- 発表時点では公開前の評価に基づく説明であり、製品版の詳細は今後のシステムカードで示される
- Astraは過去のHugging Face事案に関与したモデルではない
- 強いサイバー能力には防御用途もあるが、利用範囲と権限の厳格な管理が前提となる
編集部見解
(追記予定)
info 公開情報をもとに編集部が再構成したサマリです。一次情報・追加情報は出典欄をご参照ください。