目次
2026年9月3日、OpenAI が新しいフラッグシップ 「GPT-6 Astra」 を公開しました(OpenAI APIドキュメント)。APIはゲート無しで一般提供、モデルIDは gpt-6-astra、コンテキストは 1,050,000トークンです。
ただし「公開された」と「あなたのプランで使える」は別の話でした。OpenAI 自身が「限定的な組織から順次」と告知しており、ChatGPT Plus では通常のチャット画面に出てきません。この記事の2章は、その一点だけを知りたい人のために独立させてあります。
そしてもう1つ、他の解説記事とこの記事が違う点があります。ベンチマークの数値表を載せていません。OpenAI が挙げた指標名は載せますが、値は発行元のページに辿り着けたものだけです。理由は4章で書きます——結論だけ先に言うと、いま出回っている「GPT-6 Astra 74.1% 対 Claude Opus 5 96%」の類の比較は、そもそも別の物差しで測った値を並べています。
GPT-6 Astra
2026年9月3日公開 / API は一般提供
出典: OpenAI
1. リリース概要——日付・スペック・提供範囲
OpenAI は GPT-6 Astra を 「現時点で最も知的なモデル」と位置づけ、コンピュータ操作・ブラウジング・ソフトウェア工学・科学・専門職業務で最先端の性能を持つと説明しています。公式の言い方は「コード、ブラウザ、業務ソフトをまたぐ複数手順のワークフローの遂行に優れる」で、一問一答よりも「長く動く仕事」に軸足を置いた説明になっています(OpenAI モデルガイダンス)。
| 項目 | GPT-6 Astra | 備考 |
|---|---|---|
| 公開日 | 2026年9月3日 | 限定的な組織から順次拡大 |
| モデルID | gpt-6-astra | APIはゲート無し |
| コンテキスト | 1,050,000トークン | 入力上限 922,000 |
| 最大出力 | 128,000トークン | — |
| 知識カットオフ | 2026年4月30日 | 詳細はカットオフ日一覧 |
| 推論の強度 | low / medium / high / xhigh / max | none は非対応 |
| 対応機能 | ストリーミング、構造化出力、関数呼び出し、ファイル検索、画像入力、Web検索、プロンプトキャッシュ | — |
| レート制限 | 500〜15,000 RPM / 500K〜40M TPM | 利用ティアによる |
272,000トークンを超える入力には割増がかかります。入力とキャッシュが2倍、出力が1.5倍です。100万トークンのコンテキストは「使えば使うほど単価が上がる」設計で、入れられることと、入れて得なことは別だと考えたほうがよいでしょう。
2.「Plusなのに出てこない」の正体——プラン別の提供状況
公開直後に最も多く見られた困りごとがこれです。結論から言うと、Plus でも Astra は使えますが、通常のチャット画面には出てきません。
以下は OpenAI 開発者コミュニティの公式告知と、OpenAI 公式アカウントの投稿にもとづく整理です。
OpenAI は公式アカウントで、初日は「限定的な組織」に、その後数日かけて Plus / Pro / Business / Enterprise と API・AWS へ広げると告知しました。その翌日には 「Pro・Enterprise・Business Premium では ChatGPT Work と Codex で利用可能。API でも稼働中。Plus と Business への展開には数日かかる可能性がある」と補足しています。
一般提供。ゲートも順番待ちもなく、gpt-6-astra を指定すれば使えます。いま確実に触れるのはここ。
ChatGPT Work と Codex で利用可能。公式が「全ユーザーに提供済み」と明言している範囲です。
ChatGPT Work と Codex のみ。通常のチャット画面のモデル一覧には出てきません。探すなら Work か Codex のモデル選択です。
要するに、探す場所が違います。「ChatGPT を開いてモデル一覧を見る」→ 出てこない、で止まっている人が多いのですが、Plus の入口は Work と Codex です。
🟡 「数日待てば通常のチャットにも並ぶ」とは書けません。OpenAI の当初の告知は「数日のうちに全 Plus ユーザーへ」でしたが、公開から5日が経った2026年9月8日時点でも、Plus の通常チャットには来ていません。OpenAI の開発者フォーラムには「全 Plus ユーザー向けと告知されたのに、Plus のアクセスは Work / Codex に限られている」として説明を求めるスレッドが立っており、通常のチャットで使うには Pro が必要だとする報道もあります。
当初の告知は「予定」であって「確定した提供日」ではない——いま Plus で確実に使えるのは Work と Codex です。(2026年9月8日時点。状況が変われば追記します)
3. 価格——$10/$50は高いのか、という問いの立て方
API価格は入力 $10 / 出力 $50(100万トークンあたり)。Claude Opus 5 の $5 / $25 のちょうど2倍で、単価だけ見れば高い部類です。
ただし OpenAI は同じドキュメントで、「より少ない出力トークンでより良い結果を出すため、1タスクあたりの推定APIコストはむしろ低い」と主張しています。推論モデルの請求額は「単価 × 実際に吐いたトークン数」で決まるので、単価が2倍でも出力が半分以下なら総額は下がります。
ここは鵜呑みにしないでください。「出力が少ないので安い」はOpenAI自身の見積もりであって、第三者の実測ではありません。しかもタスクの性質で簡単に逆転します——短い返答を大量に投げる用途なら単価がそのまま効きますし、長考させる設定(xhigh / max)では出力トークンは増えます。
自分の代表的なタスクを10本流して請求額を見る——これ以外に確かめる方法はありません。
4. ベンチマーク——横並び比較が成り立たない理由
OpenAI が Astra について「最先端の結果」と述べた指標は次のとおりです(OpenAI 開発者コミュニティの公式告知)。指標名は公表されていますが、この告知に数値の表は付いていません。
並びを見て気づくことがあります。コンピュータ操作・ターミナル・エージェント寄りの指標が中心で、いわゆる知識問答系がほとんどありません。1章の「長く動く仕事に軸足を置いた」という説明と一致しています。
数値を載せなかった理由
各所の解説記事には 「Astra 74.1% 対 Claude Opus 5 96%」のような表が載っています。この記事はそれを載せません。比較として成立していないからです。
OpenAI がコーディングで挙げるのは DeepSWE 系、Anthropic が挙げるのは SWE-bench Verified。名前が似ているだけの別テストで、難易度も採点方法も違います。片方の数字をもう片方の隣に置いた時点で、その表は意味を失っています。
出回っている数値の多くはまとめ記事どうしの引き写しで、発行元のページを開くと同じ値が見つからないものがあります。当サイトは発行元まで辿れない数値は載せない方針です。
上位モデルが軒並み90%台後半に張り付いた指標では、1〜2ポイントの差に意味がありません。「勝った」と書ける差でも、実務の体感には結びつきません。
では何と比べればいいのか。同じ物差しで両方の値が公表されているものだけです。たとえば当サイトが Opus 5 の記事で扱った DeepSWE v1.1 は、Opus 5 が 68.8%、GPT-5.6 Sol が 72.7% と同じテストの値が並んでいるので比較が成立します。Astra の同指標の値は、発行元のページで確認できしだい追記します。
5. サイバー能力が「Critical」に達した初のモデル
スペックよりも大きなニュースはこちらかもしれません。OpenAI は、GPT-6 Astra を自社の Preparedness Framework で「サイバーセキュリティ能力 Critical」に達した初のモデルと位置づけました(OpenAI Deployment Safety Hub、システムカード公開 2026年9月3日)。
公式の説明では、Astra はまだ知られていない脆弱性を見つけ、それを突く新しい方法を、堅牢なシステムに対して人の逐一の指示なしに編み出せる水準にあります。安全対策を外した状態の評価では、堅牢化されたブラウザで任意コード実行に至る経路や、堅牢化されたOSでの権限昇格を成立させたと記載されています。
| OpenAIが公開している値 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|
| ExploitBench(1回で成功) | 88.0% | 55.9% |
| ExploitBench(4回以内で成功) | 99.2% | 68.7% |
| Gray Swan IPI Arena 攻撃成功率 (低いほど守れている) | 8.5% | 27.0% |
| HealthBench Professional(長さ調整済み) | 63.4 | — |
| Codexシミュレーションでの重大度3以上の逸脱 | 0.063%(54,218件中34件) | — |
攻撃側の能力が上がった一方で、攻撃を受ける側としては強くなっています。間接プロンプトインジェクションの攻撃成功率は Sol の 27.0% から 8.5% へ下がりました。エージェントに外部のWebページを読ませる用途では、これは実務的に効く改善です。
OpenAI が取った対応は「能力を落とす」ではなく「用途で切り分ける」でした。セキュアコードレビューやパッチ適用といった防御側の作業には応じる一方、既知の脆弱性に対する実証コードの作成のような攻撃寄りの依頼は拒否します。加えて、全ツール使用推論への監視の拡大、重大な操作に対する利用者確認、18歳未満への安全境界の調整が入り、生物研究とサイバーセキュリティ研究については審査つきの限定アクセス枠が別途用意されています。
この「線の引き方」は、9月に出た他の新モデルにも共通しています。各社とも、最も危険な能力の周りに囲いを作り、資格のある相手にだけ開ける方式を取りました。「全部入りで全員に配る」時代が終わりつつある——今回の3連続リリースで最も見落とされている変化はここだと思います。
6. 開発者向け——移行で壊れるもの
既存コードから乗り換える場合、そのままではエラーになる箇所があります。OpenAI のモデルガイダンスに明記されている変更点は次のとおりです。
temperature top_p top_logprobs などは渡さない。推論モデルでは効かないだけでなく、拒否される場合があります。
Chat Completions ではツール対応が限定的。エージェント用途なら実質必須です。
none の推論強度が無いnone や minimal を使っていたなら low から始めて結果を比べる、と公式が指示しています。
prompt_cache_retention は prompt_cache_options.ttl へ。名前だけの変更ですが、黙って無視されるとキャッシュが効かず請求だけ増えます。
挙動面では、Astra は以前より利用者に質問を返しやすいと公式が明記しています。人が横にいる対話では有り難い性質ですが、無人で回すバッチ処理では止まる原因になります。自律実行させたいなら、その旨をプロンプトで明示してください。
もう1点、Fast モードは EU データレジデンシー環境では利用できません。またレイテンシのSLAも付きません。応答速度を前提に設計する場合は注意してください。
7. Claude Opus 5 / Gemini 3.8 Flash との比較
2026年9月1日から3日にかけて、Anthropic・Google・OpenAI が3日連続で新モデルを出しました。現行の顔ぶれを、公表値が確認できる項目だけ並べます。
| モデル | 公開日 | 入力/出力(100万トークン) | カットオフ | コンテキスト |
|---|---|---|---|---|
| GPT-6 Astra | 2026年9月3日 | $10 / $50 | 2026年4月30日 | 1,050,000 |
| Claude Opus 5 | 2026年7月24日 | $5 / $25 | 2026年5月 | 1,000,000 |
| Claude Fable 5.1 | 2026年9月1日 | $10 / $50 | 2026年6月 | 1,000,000 |
| Gemini 3.8 Flash | 2026年9月2日 | $0.75 / $3.75 (導入価格・2026年12月31日まで) | 2026年3月 | 1,000,000 |
読み取れることを3つ。
① 最上位帯の価格が $10/$50 で揃いました。Astra と Fable 5.1 が同額です。一方で Anthropic は「ほとんどの用途は Opus 5 から」という案内を変えていないので、$5/$25 の Opus 5 が実質の主戦場という構図は続いています。
② 知識の新しさは Fable 5.1 が先頭。2026年6月で、Opus 5(5月)、Astra(4月30日)、Gemini 3.8 Flash(3月)が続きます。ただしWeb検索を併用する使い方では、この差は実務にほとんど響きません。カットオフが効くのは検索を切ったときです。
③ 桁が違うのは価格。Gemini 3.8 Flash は導入価格で入力が Astra の約13分の1です。「賢さ」で並べると団子になり、「コスト」で並べると桁で分かれる——これが2026年秋の実像で、前世代の比較のときより差がはっきりしています。
8. 注意点——この記事が数字を載せなかったもの
正直に書いておきます。この記事には、他所の解説にあってここに無い数字があります。
DeepSWE や FrontierMath、ARC-AGI の具体値は、発行元のページに辿り着けなかったため載せていません。数字が確認でき次第、追記します。
「5時間あたり何通」という数字が出回っていますが、公式ヘルプの記載として確認できていません。展開中は変動する性質の値でもあります。
スペック・価格・移行時の変更点はAPIドキュメントとモデルガイダンス、安全性の数値はDeployment Safety Hubから。いずれも発行元のページで確認しています。
そしてもう1つ。公開直後の情報は動きます。提供範囲は数日単位で変わりますし、価格や制限も改定されえます。この記事は2026年9月時点の内容です。
9. 用途別おすすめ——いつ Astra を選ぶか
長く自律して動く仕事。ブラウザや業務ソフトをまたぐ複数手順の作業、ターミナル作業、外部Webを読ませるエージェント(プロンプトインジェクション耐性が上がっているため)。
単価を半分に抑えたいとき。文章の質や一般的なコーディングでは、いま公表されている範囲で決定的な差は見えていません。Opus 5 で足りるなら、それが安上がりです。
桁で効くのは価格。要約・分類・下書きを大量に流す用途では、Gemini 3.8 Flash の導入価格が圧倒的です。Gemini の全体像も参考に。
課金の前に手触りを確かめる。各社の無料枠でひととおり触ってから決めても遅くありません。3社の無料枠比較。
最後に、いちばん確実な決め方を書いておきます。ベンチマークの表を眺めるより、自分の代表的なタスクを10本、同じ入力で2〜3モデルに流すほうが早いです。かかった時間と請求額と、出てきたものの質。この3つを自分の目で見れば、どの表よりも正確な答えが出ます。
FAQ
Q1. GPT-6 Astra はもう使えますか?
APIは2026年9月3日から一般提供されており、ゲートも順番待ちもありません。ChatGPT側は順次展開で、Pro・Enterprise・Business Premium は ChatGPT Work と Codex で利用できます。Plus と Business Standard も対象ですが、展開に数日かかる旨を OpenAI が告知しています。
Q2. ChatGPT Plus なのにモデル一覧に出てきません。
探す場所が違う可能性が高いです。Plus で使えるのは ChatGPT Work と Codex で、通常のチャット画面のモデル一覧には出てきません。そちらのモデル選択を確認してください。なお OpenAI の当初の告知は「数日のうちに全 Plus ユーザーへ」でしたが、公開から5日経った2026年9月8日時点でも通常のチャットには来ておらず、OpenAI の開発者フォーラムには説明を求めるスレッドが立っています。通常のチャットで使うには Pro が必要だとする報道もあるため、「待てば来る」とは断定できません。
Q3. Claude Opus 5 と比べてどちらが優秀ですか?
用途によります。そして現時点では、公表されている数値で優劣を断定できません。OpenAI と Anthropic はコーディングで違うベンチマーク(DeepSWE系とSWE-bench Verified)を使っているため、両社の数字を並べた比較表は成立していないからです。価格は Astra が $10/$50、Opus 5 が $5/$25 で、Opus 5 のほうが安価です。
Q4. 価格が Opus 5 の2倍ですが、本当に高くつきますか?
タスク次第です。OpenAI は「出力トークンが大幅に少ないため1タスクあたりの推定コストはむしろ低い」と説明していますが、これは自社の見積もりです。短い返答を大量に投げる用途では単価がそのまま効きますし、xhigh や max で長考させれば出力は増えます。自分の代表的なタスクで請求額を実測してください。
Q5. 既存のコードから移行するとき、何が壊れますか?
主に4点です。temperature や top_p などサンプリング系の引数を外すこと、Chat Completions ではなく Responses API を使うこと、推論強度の none が使えないこと(low から始めて比較する、と公式が指示)、prompt_cache_retention が prompt_cache_options.ttl に変わったことです。最後の1つは黙って無視されるとキャッシュが効かず請求だけ増えるので注意してください。
Q6.「サイバー能力が Critical」とは、危険なモデルということですか?
OpenAI の Preparedness Framework における能力の水準を指す言葉で、危険性の判定ではありません。Astra はこの水準に達した初のモデルで、そのため OpenAI は用途で線を引いています。セキュアコードレビューやパッチ適用など防御側の作業には応じますが、実証コードの作成のような攻撃寄りの依頼は拒否します。むしろ攻撃を受ける側としては強くなっており、間接プロンプトインジェクションの攻撃成功率は GPT-5.6 Sol の 27.0% から 8.5% へ下がっています。
Q7. 100万トークンのコンテキストは、使えば使うほど得ですか?
いいえ。272,000トークンを超える入力には割増がかかり、入力とキャッシュが2倍、出力が1.5倍になります。長大な文脈を丸ごと入れるより、必要な部分を選んで渡すほうが安く済む場面が多くなります。
出典
この記事の数値は、すべて下記の発行元のページで確認したものです。まとめ記事からの引き写しは含めていません。
- OpenAI — GPT-6 Astra Model(APIドキュメント)
モデルID、コンテキスト(1,050,000/入力922,000/出力128,000)、価格($10 / $50 / キャッシュ$1・$12.50)、272Kトークン超の割増、カットオフ2026年4月30日、推論強度、対応機能、レート制限 - OpenAI — Model guidance
位置づけの文言、「出力トークンが少ないため1タスクあたりの推定コストは低い」、移行時の変更点4点、Fastモードの制約、質問を返しやすい挙動 - OpenAI — Deployment Safety Hub: GPT-6 Astra
Preparedness Framework のサイバー能力 Critical、ExploitBench(88.0% / 99.2% と Sol の 55.9% / 68.7%)、Gray Swan IPI Arena(8.5% と 27.0%)、HealthBench、逸脱率0.063%、安全対策と拒否の方針。システムカード公開 2026年9月3日 - OpenAI — GPT-6 Astra 告知(開発者コミュニティ)
公開日2026年9月3日、プラン別の提供範囲、最先端と述べたベンチマーク名の一覧 - OpenAI 開発者フォーラム — Plus のアクセス範囲についての確認スレッド
「全 Plus ユーザー向けと告知されたが、実際のアクセスは Work / Codex に限られている」という指摘。2章の 🟡 の根拠 - OpenAI — GPT-6 Astra 公式発表ページ
公式の一次発表。なお当サイトからの自動取得はブロックされるため、上記の告知とドキュメントで内容を確認しています
関連記事
- Claude Opus 5 リリース完全解説——比較対象になる現行フラッグシップ
- GPT-5.6 リリース完全解説——前世代。Luna / Terra / Sol の3モデル体制
- Claude Fable 5.1 の破壊的変更と移行——同じ週に出たもう1つの新モデル
- 主要AIの知識カットオフ日一覧——各モデルが「いつまで」を知っているか