一次情報で読む、いまのAI
← すべてのニュース

GPT-6 Astra安全概要公開

目線

エージェントやコーディングAPI利用者は、サイバー能力制限と拒否境界の強化を確認し、既存モデルとのコスト・性能比較を進める段階。

対象

OpenAI API・ChatGPT Plus/Pro/Enterprise利用者、エージェント開発者

使える場面

  • 高度なコーディングやコンピュータ利用タスクの試作
  • サイバー防御用途の限定アクセス検討

試すなら

system cardとAPI提供条件を確認する

確認点

高度なサイバー能力はDaybreak等の限定テスター向けで一般APIに制限あり

背景

GPT-6 AstraはOpenAIが広く展開する最も有能なモデルで、Preparedness Framework上初のサイバーCriticalに到達。開発・展開前に保護を強化した。

何が変わったか

  • 未知の脆弱性発見・悪用チェーン構築が可能になりCritical閾値到達
  • jailbreak耐性が前世代(GPT-5.6 Sol)より大幅向上し、長軌跡でも堅牢
  • アラインメント強化でCodexタスクシミュレーションの高深刻度フラグが約半分
  • 高リスクユーザー向け拒否境界調整やmisalignment監視を広範に導入

使える場面・影響

一般利用者は性能向上を享受できる一方、高度サイバー機能は制限され、内部・外部のセーフガードが強化されるため、悪用リスクの高い用途では挙動変化に注意が必要。

試す前に確認

  • ChatGPT Plus/Pro/Business/EnterpriseおよびAPI・AWSで順次提供
  • 高度サイバーは限定テスター(Daybreak Blue)優先
  • system cardで詳細評価を確認

一次ソース