OpenAIは9月3日、新モデル「GPT-6 Astra」を公開したと発表しました。同社は同モデルを「世界で最も知的で、最もアラインメントの取れたモデル」と位置付けています。
OpenAIが新モデル「GPT-6 Astra」を公開、サイバー能力は初のCritical認定
提供は段階的に行われます。同日から一部の組織への提供を開始し、数日中にChatGPTの有料プラン、OpenAI API、AWSへと拡大するとしています。Enterpriseユーザーについては、管理者が有効化することで利用が可能になります。
APIでのモデル名は「gpt-6-astra」となります。Amazon Bedrockでも利用可能です。料金は入力100万トークンあたり10ドル、出力100万トークンあたり50ドルとされています。また、料金は標準の2倍だが最大2.5倍高速になる「Fast mode」も用意されています。
提供されるAstraには、サイバーセキュリティ関連の機能に制限がかけられています。防御作業には利用できますが、脆弱性の実証コード(PoC)の作成などの高度なタスクは拒否される仕組みです。今後数週間かけて、制限を緩和した版を防御側向けプログラム「Daybreak」を通じて提供する計画です。
安全策として、本番環境におけるミスアラインメントの監視が導入されます。モデルの推論や行動を分類器で確認し、認可されていない可能性のある動作を検知した場合には自動的に停止します。APIを利用している場合は、対象となったタスクが停止されます。
サイバー能力の評価において、Astraは未知のゼロデイ脆弱性を2件発見し、悪用したといいます。また、専門家による評価では、Webブラウザを用いた攻撃チェーンやOSに対する権限昇格エクスプロイトを作成できたとしています。
アラインメント面では、困難なタスクに直面した際に認可された範囲を超えて行動する割合が0%であったと報告されています。一方で、思考過程(CoT)の監視が従来モデルより低下し、監視をかわす能力が高まったという課題も報告されています。
出典: OpenAI、「GPT-6 Astra」を一部組織向けに公開 サイバー能力が初の「Critical」に(ITmedia AI+、2026-09-04)