AI・生成AI OpenAIが新型「GPT-6 Astra」公開、史上初の「Critical」級サイバー能力は何をもたらすのか。独立ベンチマーク61点の意味を見極める OpenAIが2026年9月3日に公開したGPT-6 Astra。自社基準で史上初めて「Critical」級サイバー能力を持つ状態のまま一般提供に踏み切った経緯と、独立ベンチマークで前モデルと同点だった評価の中身を整理した
30秒で分かる結論
米OpenAIは2026年9月3日(米国時間)、新型AIモデル「GPT-6 Astra」を公開しました。提供は段階的で、まずサイバーセキュリティ用途向けの申請制プログラム「Daybreak」の参加組織に先行提供され、その後数日かけてChatGPTのPlus・Pro・Business・Enterprise利用者、そしてAPIやAmazon Web Services・Microsoft Azure経由でも利用できるようになる予定です。OpenAIはAstraを「世界で最も知能が高く、意図に沿ったモデル」と位置づけ、コーディングやコンピュータ操作、ブラウジング、科学分野などで最高水準の性能を持つとしています。最大の特徴は、自社の安全性の枠組み「Preparedness Framework」において、サイバー攻撃能力が最高レベルの「Critical(重大)」水準に達したと判断された、OpenAIとして初めての一般提供モデルである点です。これを受けてOpenAIは、強化された安全対策を伴う形での提供に加え、以前から用意していたサイバーセキュリティ専門家向けの申請制プログラム「Daybreak」の対象を広げるとともに、重要インフラ事業者などを対象に総額10億ドル相当の割引提供・研修・技術支援を行う新プログラム「Daybreak for Frontline Defenders」を発表しました。一方、第三者機関Artificial Analysisの「Intelligence Index」による採点では、Astraの総合知能スコアは61点で、前モデル「GPT-5.6 Sol」と同じ数値にとどまり、Anthropicの「Claude Fable 5.1」(66点)やMetaの「Muse Spark 1.3」を下回っています。API料金は標準で入力100万トークンあたり10ドル、出力100万トークンあたり50ドルです。
まず初めに
「世界一賢いAI」「AGI(汎用人工知能)の到来かもしれない」と、OpenAIの社長みずから太鼓判を押して送り出した新型モデルが、いざ第三者に採点させてみたら前のモデルと同じ点数だった。新型車を華々しく発表したら、カタログのスペック表が前年モデルのコピー&ペーストだったようなものである。もちろん、サイバー攻撃能力が自社史上初めて「Critical」に達したという話自体は、笑い事では済まされない重みを持つ。だが、そのシリアスな話と、景気の良いキャッチコピーが同じ発表の中に同居しているところに、今のAI業界らしい落差を感じずにはいられない。※個人の感想です
生成AIによるイメージ。実物や実際の画面ではありません。
何が起きているのか
OpenAIは2026年9月3日(米国時間)、新型AIモデル「GPT-6 Astra」を公開しました。「Astra」という開発コード名自体は、2026年8月1日付のOpenAI公式ブログで、数学と理論計算機科学の未解決問題を解いたという発表の中で初めて公になっていました。さらに2026年8月7日には、OpenAIが「Astra」の内部安全性評価の結果、サイバー攻撃能力が自社基準で最高レベルの「Critical(重大)」水準に達している可能性を否定できないと発表し、一部の社内利用・開発を一時的に制限していたことは、IT Postでも取り上げています。その後2026年9月1日から2日にかけて、OpenAIはAstraが実際にこの「Critical」水準を越えたと公式に発表し、既知の脆弱性を突く評価「ExploitBench」で満点を取ったこと、自力で未知の脆弱性を発見したことなどを明らかにしていました。この時点では製品名が「GPT-6」になるか別の番号になるかは確定しておらず、開発者コミュニティの間では、OpenAIのAPI上に「gpt-6-astra」という名称が見つかったという観測も広がっていました。今回の発表で、こうした一連の経緯を経てきたAstraが、正式に「GPT-6 Astra」として一般提供される段階に至ったことが確定しました。
提供は段階的です。まずサイバーセキュリティ専門家向けの既存プログラム「Daybreak」の参加組織に先行提供され、その後数日かけてChatGPTのPlus・Pro・Business・Enterpriseの各プランの利用者、そしてOpenAIのAPI、Amazon Web Services(Bedrock)、Microsoft Azure経由でも利用できるようになる予定です。OpenAIはAstraについて、コンピュータ操作(computer use)やブラウジング、ソフトウェア開発、科学分野、専門的な業務といった幅広い領域で最高水準の性能を持つと説明しています。OpenAI社長のグレッグ・ブロックマン氏は、今回の更新を「世代を超えた飛躍」と表現し、AGI(汎用人工知能)の到来と将来的に位置づけられる可能性にも言及しています。
今回最大の焦点は、Preparedness Frameworkにおける「Critical」水準への到達です。この水準は、人間の逐次的な指示なしに、堅牢に防御された実際の重要システムに対して未知の脆弱性を自力で発見・悪用できる、といった能力を意味します。*8月時点では「その可能性を否定できない」という慎重な言い回しだったが、今回は一般提供に踏み切ったという点で、話がひとつ先に進んだ。*これを受けてOpenAIは、通常より強化された安全対策を適用するとともに、サイバーセキュリティの専門家がAstraの能力を脆弱性検証やマルウェア解析、検知技術の開発などに活用できるよう、既存の申請制プログラム「Daybreak」の対象を広げました。あわせて、水道・電力事業者や地方自治体、地域金融機関、非営利団体、オープンソースの保守担当者などを主な対象に、総額10億ドル相当の割引提供・研修・技術支援を行う新プログラム「Daybreak for Frontline Defenders」も発表しています。
一方で、第三者のベンチマーク (性能評価)分析を手がけるArtificial Analysisの「Intelligence Index」による採点では、Astraの総合知能スコアは61点でした。この数値は、前モデルである「GPT-5.6 Sol」と同じ点数であり、世代を追った知能スコアの向上が見られない結果となっています。同じ指標でAnthropicの「Claude Fable 5.1」は66点、Metaの「Muse Spark 1.3」もAstraを上回るスコアを記録しています。また、AIが複数の手順を自律的にこなす「エージェント」的な作業を測る指標では51.5点にとどまり、総合知能スコアの61.2点との間に差が見られました。API料金は、標準モードで入力100万トークンあたり10ドル、出力100万トークンあたり50ドルで、高速に処理する「Fast」モードは処理速度が最大2.5倍になる代わり、料金も2倍になります。
なぜ重要なのか
今回の発表が重要なのは、OpenAIが自社基準で「Critical」水準に達したと判断したAIモデルを、実際に一般提供へ踏み切った初めてのケースだからです。8月時点の「一時的な利用制限」という慎重な対応から一歩進み、強化された安全対策とともに市場投入するという判断は、AI企業がサイバー攻撃能力の高いモデルとどう向き合っていくかを占う先例になります。特に、専門家向けにあえて安全対策を一部緩めた「Daybreak」のような仕組みを用意したことは、高い能力を持つAIを、攻撃にではなく防御(脆弱性の発見・対策)にどう活用してもらうかという課題への一つの回答といえます。
もう一つ重要なのは、OpenAI自身の華々しい謳い文句と、独立した第三者機関の採点結果に開きが生じている点です。「世界一賢い」「AGIの到来」といった表現の一方で、広く参照されているArtificial Analysisの指標では前モデルと同点、しかも料金は大幅に上がっているという結果は、AI企業の自社発表だけを鵜呑みにせず、独立した評価と突き合わせて確認することの重要性を、あらためて浮き彫りにしています。
私たちへの影響
一般のChatGPT利用者にとっては、数日以内にPlus・Pro・Business・Enterpriseの各プランでGPT-6 Astraが使えるようになる見込みです。コーディング支援やコンピュータ操作の自動化など、既存の作業を効率化できる可能性がある一方で、独立採点上は前モデルからの知能面での明確な向上が確認できていないため、料金上昇に見合う体感差があるかどうかは、実際に使ってみて判断する必要があります。
企業のセキュリティ担当者にとっては、「Daybreak」プログラムを通じて、高度なサイバー攻撃能力を持つAIを脆弱性診断やマルウェア解析に活用できる可能性が開けます。水道・電力などの重要インフラ事業者や地方自治体、地域金融機関、非営利団体、オープンソースの保守担当者にとっては、「Daybreak for Frontline Defenders」による割引提供・研修・技術支援の対象になり得る点も注目に値します。
初心者が知っておくべきこと
「Preparedness Framework」とは、OpenAIが2023年に策定した、自社AIモデルの自律的じりつてき なサイバー攻撃能力や生物・化学兵器への転用リスクなどを段階的に評価する安全性の枠組みです。この枠組みの中でサイバー分野の最高レベルとされる「Critical」は、人間の逐次的な指示なしに、堅牢に防御された実際の重要システムに対して、あらゆる深刻度の未知の脆弱性を自力で発見・悪用できる、という高い水準を意味します。
「Intelligence Index」とは、Artificial Analysisという第三者機関が、複数のAIモデルの性能を推論・知識・数学・コーディングなど複数の観点から測定し、一つの指標にまとめて比較できるようにしたベンチマーク(性能評価の物差し)です。AI開発企業自身が発表する性能値とは独立した、比較的客観性の高い指標として広く参照されています。
よくある質問
Q. GPT-6 Astraはいつから誰でも使えますか?
A. 2026年9月3日にまずサイバーセキュリティ専門プログラム「Daybreak」の参加組織へ先行提供されました。その後数日かけて、ChatGPTのPlus・Pro・Business・Enterprise利用者、APIやAWS Bedrock、Microsoft Azure経由でも順次利用できるようになる予定です。
Q. 独立採点のスコアが前モデルと同じというのは本当ですか?
A. 第三者機関Artificial Analysisの計測によると、総合知能を示す「Intelligence Index」でGPT-6 Astraは61点を記録し、前モデルのGPT-5.6 Solと同じ数値でした。OpenAI自身は自社発表の中で高い性能をアピールしていますが、両者の評価には開きが見られます。
IT Postの見方
IT Postでは、今回の発表を「安全対策の設計は評価できるが、宣伝文句が独立採点に追いついていない」と受け止めています。
「Critical」水準に達したモデルを、いきなり無条件で全世界にばらまくのではなく、専門家向けの申請制プログラムを間に挟み、しかも重要インフラの守り手側への支援まで用意したという段取りは、AI企業の安全対策として筋が通っている。ここは素直に評価したい。*一方で、「世界一賢い」「AGIの到来か」という景気の良い言葉を並べておきながら、独立した採点では前モデルと同点、しかも値段は上がっているというのは、正直かなり格好がつかない。*サイバー能力という一点だけは間違いなく本物の飛躍なのだろうが、それ以外の「賢さ」の部分まで同じテンションで語ってしまうと、話半分に受け取られても仕方がない。IT Postとしては、こうした発表を見るときは、開発企業自身の言葉より先に、独立した第三者の採点を確認する習慣をつけることを、あらためて勧めたいと考えます。※個人の感想です
今後どうなりそうか
今後は、ChatGPTの各プランやAPIへの提供完了が進むとともに、独立したセキュリティ研究者による「Critical」水準の実際の検証や、Daybreakプログラムを通じた重要インフラ事業者での活用事例が明らかになっていくとみられます。IT Postでは、独立機関による追加の性能検証結果や、実際にAstraが関わったセキュリティ上の事例が確認された場合には、あらためて取り上げます。