2026.09.03 THU09:00 JSTOpenAI
GPT-6 Astra安全概要公開
- OpenAIがGPT-6 Astraを広く展開開始。
- Preparedness Frameworkで初のサイバーCritical到達。
- jailbreak耐性・アラインメントを大幅強化。
目線
エージェントやコーディングAPI利用者は、サイバー能力制限と拒否境界の強化を確認し、既存モデルとのコスト・性能比較を進める段階。
対象
OpenAI API・ChatGPT Plus/Pro/Enterprise利用者、エージェント開発者
使える場面
- 高度なコーディングやコンピュータ利用タスクの試作
- サイバー防御用途の限定アクセス検討
試すなら
system cardとAPI提供条件を確認する
確認点
高度なサイバー能力はDaybreak等の限定テスター向けで一般APIに制限あり
背景
GPT-6 AstraはOpenAIが広く展開する最も有能なモデルで、Preparedness Framework上初のサイバーCriticalに到達。開発・展開前に保護を強化した。
何が変わったか
- 未知の脆弱性発見・悪用チェーン構築が可能になりCritical閾値到達
- jailbreak耐性が前世代(GPT-5.6 Sol)より大幅向上し、長軌跡でも堅牢
- アラインメント強化でCodexタスクシミュレーションの高深刻度フラグが約半分
- 高リスクユーザー向け拒否境界調整やmisalignment監視を広範に導入
使える場面・影響
一般利用者は性能向上を享受できる一方、高度サイバー機能は制限され、内部・外部のセーフガードが強化されるため、悪用リスクの高い用途では挙動変化に注意が必要。
試す前に確認
- ChatGPT Plus/Pro/Business/EnterpriseおよびAPI・AWSで順次提供
- 高度サイバーは限定テスター(Daybreak Blue)優先
- system cardで詳細評価を確認
一次ソース
- OpenAI Safety overview: GPT-6 Astraopenai.com