モデル
Astra、OpenAI初のCriticalサイバー能力モデルへ
原題: Path to Astra: critical capabilities and frontier safeguards
提供前に能力と安全対策を公表
OpenAIは9月1日、開発中のAstraがPreparedness FrameworkのCriticalサイバー能力基準に達したと発表しました。
OpenAIがこの水準にモデルを指定するのは初めてです。
同社は、適切なツールとアクセスがある場合、Astraは未知の脆弱性を見つけ、人の逐次指示なしで防御されたシステム向けの攻撃手法を開発できると評価しています。
AstraはGPT-5.6 Solより脆弱性発見とエクスプロイト開発の能力が高く、少ない出力トークンで処理するとOpenAIは説明しています。
社内評価では、最近公開されたV8の脆弱性20件を使う試験中に、2件の未公開脆弱性を発見して攻撃チェーンへ利用したとしています。
OpenAIは、サイバー悪用対策とモデルの不正動作監視を強化するため、Astraの開発と提供の一部を遅らせました。
提供後は、ChatGPTまたはCodexで監視機構が処理を止めた場合、利用者へ続行確認を求めることがあります。APIではその処理が停止します。
Astraの提供は近日予定で、発表時点では利用できません。
高度なサイバー作業は少数のalpha testersから始め、その後Daybreak Blue経由で防御用途へ広げる予定です。
能力値と安全性評価はOpenAI自身の試験結果で、独立評価ではありません。詳細なSystem Cardはモデル提供時に公開予定です。