AI・生成AI「gpt-6-astra」のAPIが404を返す これはOpenAIの次のモデルの足音か
X上で、OpenAIのAPIに未公開モデル名gpt-6-astraを投げると404、との観測が拡散。一方でOpenAIは次期モデルAstraが「サイバー能力の最高危険区分に初到達」と公表。分かっていることを整理した
30秒で分かる結論
2026年9月2日ごろ、X(旧Twitter)で、OpenAIのAPI(外部プログラムから機能を呼び出す窓口)に「gpt-6-astra」というモデル名を指定すると、サーバーが「404 Not Found(見つからない)」を返す、という観測が個人ユーザーの投稿から広がりました。存在しないモデル名なら通常「400(リクエストが不正)」が返るところ、404が返るのは「モデルは登録済みだが未公開」の状態を示すのではないか、という推測です。既に存在が知られる「5.6 Cyber」も同じ404を返すことが傍証とされ、前日にはAmazon Bedrock経由でAnthropicの「Fable 5.1」が正式発表前に見つかっていました。
ただし「gpt-6-astra」というAPI名そのものについて、OpenAIは何も説明していません。一方で、その直前の2026年9月1日から2日にかけて、OpenAIは次期モデル「Astra」について重要な発表をしています。Astraが同社の安全評価ルール「準備フレームワーク(Preparedness Framework)」で、サイバー能力の最高危険区分である「Critical(重大)」に、OpenAIのモデルとして初めて達した、という内容です。テストでAstraは、既知の脆弱性を突くExploitBenchで満点を取り、最近公開された欠陥を対象にした評価で自力でゼロデイ脆弱性を2件発見し、ブラウザのサンドボックスを突破して複数のOSの欠陥を連鎖させ、管理者(root)権限まで奪取しました。この能力の高さから、OpenAIは高度なサイバー機能の提供を絞り、まず少数のテスター、次に承認された防御側向けの「Daybreak Blue」プログラムへと、段階的に開くとしています。
Astraは「Solサイズ」、つまり前身のGPT-5.6 Solと同規模で、巨大モデルではありません。OpenAIは「際立った特徴は生の規模ではなく、長時間ねばり強く作業を続ける力だ」と説明しています。製品名が「GPT-6」になるか「5.7」など別の番号になるかは、まだ決まっていないと報じられています。予測市場Polymarketでは、9月15日までの公開に約59%、9月末までに約72%の確率が付いていました(9月2日時点)。
まず初めに
AIの新モデルは、いまや発表される前に「発掘」される。考古学みたいなものだ。
やっていることは、OpenAIのサーバーに「gpt-6-astraさん、いますか?」と声をかけて、返ってくるエラーの種類で在宅を推理する、である。404なら「いるけど今は出られません」。400なら「そんな人はいません」。この違いだけで記事が1本書けてしまう時代だ。そして今回は、当のOpenAIが「うちの次のやつ、ちょっと物騒すぎて出し方を絞ってます」と自分から言い出した。発掘班の推理より、公式のほうが先に不穏だった、という珍しい回である。※個人の感想です
生成AIによるイメージ。実物や実際の画面ではありません。
「404」と「400」の違い、何がそんなに重要なのか
APIにリクエストを送ると、サーバーは3桁の数字(ステータスコード)で結果を返します。「200」は成功、「400」はおおまかに「送り方・内容が不正」、「404」は「指定された場所(ここではモデル)が見つからない」を意味します。
投稿者の観測が正しければ、OpenAIのシステムは実在しないモデル名には400を、登録済みだが未公開のモデル名には404を返す、という挙動になっています。だとすれば「gpt-6-astra」への404は「枠だけ先に用意された」サインに読めます。あくまで推理で、OpenAIがこの名前を認めたわけではありません。
こうした「先回りの発見」は定期的に起きます。クラウド各社のAPIは新モデルを載せる準備を公開の数日前から始めるため、応答コードや設定ファイルに痕跡が残るのです。前日のFable 5.1はAmazon Bedrockで、8月には中国Z.aiの覆面モデル「Ox Alpha」がOpenRouterで、それぞれ正体が判明する前から存在を知られていました。Fable 5.1についてはClaude Fable 5.1とMythos 5.1が登場で解説しています。
OpenAIが認めた「Critical」——何が危険なのか
準備フレームワークは、OpenAIが自社モデルの危険な能力を分野別(サイバー、生物・化学、自律性など)に段階評価する社内ルールです。サイバーの「Critical」は、十分に防御された多数のシステムに対してモデルが自力でゼロデイ脆弱性を発見・悪用できる、あるいは高レベルの指示だけで堅牢な標的への一連のサイバー攻撃を最後までやり切れる、という水準を指します。
Astraは評価の過程で、実際にこれに近い振る舞いを見せました。自力でのゼロデイ2件発見、サンドボックス脱出、複数のOS欠陥の連鎖によるroot奪取です。防御的な使い方(自社の穴を先に見つける)には強力ですが、同じ能力は攻撃側にとっても価値があります。OpenAIはこの区分に達したモデルは「追加の安全対策なしには公開できない」と定めており、今回の慎重な出し方はそのルールに沿ったものです。安全面では、Astraはサイバー関連のジェイルブレイク(制限を外させる誘導)の試行を91.5%はねのけたとしています(前モデルは59%)。
こういう観測をどう受け取ればいいか
APIの応答コードから未公開モデルを推測する話は、当たることもあれば外れることもあります。名前が仮で製品版では変わる、公開が数か月延びる、能力が期待ほどではない、といったズレは珍しくありません。読者として安全なのは、これらを「発表が近いかもしれない」という弱いシグナルとして受け取り、性能や発売日の具体的な数字は公式発表を待つことです。「404が出たから来週リリース」と日付まで断定する記事は、根拠が観測1件のことが多いので、距離を置いて読むのが無難です。
日本の私たちに関係あるのか
Astra(製品名は未定)が公開されれば、いずれChatGPTの標準モデルとして、日本の数百万人の利用者が直接触れることになります。今回のAPIの404そのものは開発者コミュニティ内の出来事で、一般利用者が今すぐ何かする必要はありません。
意味があるのは、公開が慎重に進んでいる理由のほうです。「高性能なAIが、攻撃者の道具にもなりうる」という問題が、もはや仮定ではなく、開発元自身が公表する評価結果になりました。私たちが使うサービスの裏側で、各社の安全チームがこの能力を「どこまで解禁し、どう囲うか」を決めています。「出し惜しみ」ではなく「安全確認で足止め」なら、それはむしろ健全な慎重さです。
初心者が知っておくべきこと
APIは、外部のプログラムがあるサービスの機能を呼び出すための窓口です。ChatGPTのような画面ではなく、開発者が自分のアプリからOpenAIのモデルを使うときの入口だと考えてください。
ゼロデイ脆弱性は、開発元がまだ気づいていない(=修正までの猶予が「ゼロ日」の)ソフトウェアの欠陥です。攻撃者に先に見つかると、防ぎようがないまま悪用されます。AIが自力でこれを見つけられる、というのが今回の「Critical」判定の核心です。
**準備フレームワーク(Preparedness Framework)**は、OpenAIが自社モデルの危険な能力を段階評価し、区分ごとに必要な安全対策を定めた社内ルールです。最上位の「Critical」に達すると、追加対策なしには公開できません。
IT Postの見方
この記事は当初「OpenAIは何も言っていない」という前提で書いたが、実際には言っていた。しかも「次のモデルは強すぎて出し方を絞る」という、企業がふつう黙っていたい種類のことを、自分から出してきた。そこは評価していい。危険な能力を公表したうえで配布を絞るのは、こっそり出すより誠実だ。
一方で、API名の404を追いかける「モデル発掘」も止まらない。企業が情報を絞るほど、開発者はサーバーの応答から手がかりを拾う。公式発表と非公式の観測が、同じ数日のうちに別々に走る。健全とは言いにくいが、沈黙も断片的な小出しも選んでいるのは各社のほうだ。IT Postでは、404の1件を単独で騒ぐより、9月に入ってからのモデル乱発全体の中に置いて見るべきだと考えています。とりわけ「サイバー能力の競争」が各社共通の新しい主戦場になっている点は、便利さの話より重く扱うべきです。
今後どうなりそうか
Polymarketの確率どおりなら、9月中にAstra(あるいはその製品版)の発表がある可能性が高い状況です。焦点は、通常版がいつ・どの名前で出るか、そして「Daybreak Blue」のような防御側向けプログラムがどこまで開かれるかです。サイバー特化能力の配り方が業界で標準化されるのか、各社バラバラのままなのかも見どころになります。この数日のAIモデル乱発を横断した記事は9月アタマのAIモデル乱発はどう見てもおかしいです。