OpenAIは2026年9月3日にGPT-6 Astraを公開し、これまでで最も知的で最も適切に整合されたモデルだと表現しました。GPT-5.6 Solの後継にあたりますが、話の中心は少し賢くなったチャットボットではありません。質問に答えるだけでなく、コンピューター上の長い多段階の作業を最後までやり切るために作られたモデルです。

このガイドでは、GPT-6 Astraが実際に何なのか、ベンチマークのスコアが何を意味するのか、コンテキストウィンドウとAPI料金、今どこまで使えるのか、そしてその上に何かを作る前に知っておくべき限界を整理します。

GPT-6 Astraとは何か

GPT-6 AstraはOpenAIのフラッグシップとなる最先端モデルで、複雑な推論、コーディング、コンピューター操作、深いリサーチ、業務文書の作成といった最も難しい一連の作業を担う位置づけです。これまでのモデルは1つのプロンプトにどれだけうまく答えるかで評価されてきました。Astraは、画面を読み取り、ソフトウェアを操作し、チェックを実行し、完成した成果物を返すという一連のタスクを完了できるかどうかで評価されます。

内部構造は標準的なトランスフォーマーから離れています。OpenAIは再帰的深さ、いわゆるループ型トランスフォーマーのアーキテクチャで学習させており、同社によればこれまでで最大の学習にあたり、テキサス州のStargate拠点で10万基を超えるGPUを使ったとされています。ループ構造により、モデル全体を比例して大きくすることなく難しいステップに計算を多く割けます。長いタスクを前世代よりはるかに速く終えられる理由の大きな部分がここにあります。

GPT-6 Astraのリリース日と提供開始

GPT-6 Astraは2026年9月3日に限られた組織向けに公開され、有料のChatGPTプランはその翌日に続きました。提供は一斉ではなく段階的なので、多くの契約者がいまだにモデル選択画面で見つけられずにいます。

  • ChatGPT PlusとBusiness: 既存の月20ドルのプランに含まれますが、通常のChatではなくWorkとCodexのモードから使えます。モデルが表示されない場合はアプリ上部のメニューでモードを切り替えてください。
  • ChatGPT ProとEnterprise: 完全なアクセスに加え、最も重いワークロード向けの上位ティアGPT-6 Astra Proが用意されています。
  • OpenAI API: gpt-6-astraとして利用できますが、高度なサイバーセキュリティ機能はDaybreakという申請制プログラムの内側に置かれています。
  • クラウドプラットフォーム: Microsoft Foundry、Amazon Bedrock、GitHub Copilot。

無料ティアはありません。2026年9月時点で、OpenAIは無料のChatGPTアカウントにAstraが届くかどうか、また時期についても明言していません。

GPT-6 Astraのベンチマーク: 数字が実際に示すもの

ベンチマークの全体像は興味深い形で偏っています。Astraはエージェント的な作業と定量的な作業では圧倒的で、開かれた知識の領域では互角にとどまります。

  • OSWorld 2.0(コンピューター操作): 72.6% GPT-5.6 Solの65.7%に対する数字で、しかも1タスクあたり75分ではなく約40分で到達します。
  • FrontierMath Tier 4: 97.6% Solの83.0%に対する数字です。OpenAIはこのベンチマークを飽和したと表現しています。
  • GPQA Diamond: 96.0% 大学院レベルの科学問題での成績です。
  • ARC-AGI-3: 99.9% ただし状態を保持するアダプター環境が前提です。状態なしの実行では17%から63%に落ち、本当の汎化を重視するならこちらの数字を見るべきです。
  • Terminal-Bench 4.0: 57.7% 実際のソフトウェア開発タスクでの成績です。優秀ですが、解決にはほど遠い水準です。
  • Humanity's Last Exam(ツールあり): 57.2% 65.0%のClaude Fable 5.1に及びません。Astraがすべてで1位というわけではありません。
  • 長文コンテキストの検索精度: 96.3% 512Kから1Mトークンの帯域での数字で、512Kまでは100%の精度です。

これらを合わせて読むと構図は明快です。仕事が数学、コード、ソフトウェアの操作なら、Astraは現時点で最も強い選択肢です。幅広い開かれた領域の推論であれば、首位争いは本当に拮抗しています。

GPT-6 Astra対GPT-5.6 Sol

Solは数か月にわたってフラッグシップだったので、最も公平な比較対象です。4つの違いが特に重要です。

  • 長いタスクでの速度: OSWorld 2.0で1タスクあたりの時間が約47%短縮されます。見張っている作業と、任せられる作業の差です。
  • 数学と科学: FrontierMath Tier 4が83.0%から97.6%へ跳ね上がり、両モデル間で最大の差になっています。
  • アライメント: OpenAIは現実的な環境での不整合な結果の割合を3.4%と報告しており、Solの18.8%から下がっています。
  • アーキテクチャ: ループ型トランスフォーマーは効率を生む一方で推論の痕跡を見えにくくします。これはただの利益ではなく本物のトレードオフです。

コンテキストウィンドウと料金

大きな文書をモデルに渡す人にとってコンテキストウィンドウは最重要の数字であり、料金には見落としやすい段差があります。

  • コンテキストウィンドウ: 入力で約105万トークン、テキストにしておよそ1,600ページ分で、1回の応答で最大128,000トークンを出力できます。
  • 標準のAPI料金: 入力100万トークンあたり10ドル、出力100万トークンあたり50ドル、キャッシュ済み入力は100万トークンあたり1ドルです。
  • 長文コンテキストの料金: 入力が272,000トークンを超えるリクエストは上位の料金帯になり、100万トークンあたり入力およそ20ドル、出力75ドルです。100万トークンのプロンプトを日常的に投げるのは安い習慣ではありません。
  • 知識のカットオフ: 2026年4月です。それ以降の情報はウェブ検索か、自分で渡すコンテキストが必要になります。
Omni AIでこのプロンプトを試す: 「私の用途に合う主要なAIモデルを比較してください。私が主にやっているのは[あなたの仕事を書く]です。推論力、速度、コストでそれぞれを採点し、普段どれを使うべきか、どんなときに切り替える価値があるかを教えてください。」

GPT-6 Astraが最も向いている用途

モデルにはそれぞれ形があります。Astraの形は、ゴールがはっきりした、ツールを多用する長い作業です。

  • エージェント的なコンピューター操作: 多数のステップにまたがってデスクトップを操作し、フォームを埋め、QAを回し、人間が1クリックずつ中継しなくてもアプリ間を行き来します。
  • ソフトウェア開発: スニペット欄ではなく実際のリポジトリの中でコードを書き、レビューし、修正します。
  • リサーチと分析: 非常に大量の一次資料を読み、信頼に値する程度に細部を保持し続けます。
  • 文書と成果物の作成: 汎用的なレイアウトではなく、あなたのテンプレートに沿ったレポート、スライド、スプレッドシートを作ります。
  • 防御的なセキュリティ業務: 安全なコードレビューとパッチ適用に対応し、攻撃的な能力は意図的に制限されています。
最先端モデルの正直な試金石は、もはや答えが賢そうに聞こえるかどうかではありません。タスクが終わっていて、正しく、自分でやるより短い時間で済んだかどうかです。

限界と安全性への懸念

AstraはOpenAIのサイバーセキュリティ能力に関する社内基準でCriticalの水準に達した最初のモデルであり、そのためエクスプロイト関連のアクセスは審査済みのテスターに限定されています。ExploitBenchでは100%を記録しました。見事な結果であると同時に、制限がかかっている理由そのものです。

ループ型アーキテクチャは安全性研究者からの批判も招いています。圧縮された内部ループで推論するモデルは、思考の連鎖を読める形で書き出すモデルより監視が難しいからです。OpenAIの社長はこのリリースを汎用人工知能の到来と公に結びつけていますが、この見方には異論があり、独立した評価が追いつくまではマーケティングとして扱うのが妥当です。従来の注意点も変わりません。以前のモデルより幻覚は減りましたが、ゼロではなく、結果に影響する事実は今も確認する価値があります。

GPT-6 Astraの使い方

アクセス方法は、どの入り口から入るかで完全に変わります。

  1. ChatGPT Plusの場合: モデルメニューを開いてChatからWorkに切り替えるか、Codexを使います。PlusティアではAstraは通常のチャットの選択肢に出てきません。
  2. APIの場合: gpt-6-astraを直接呼び出します。コストが気になるなら272,000トークンの境目に注意してください。
  3. マルチモデルのアプリの場合: AI企業ごとに別々のサブスクリプションを払うのではなく、複数の最先端モデルを並べて使えるアプリを選びます。実際にどう機能するかはすべてのAIモデルを1つのアプリでをご覧ください。

Omni AIではProプランでGPT-6 Astraを利用でき、GPT-5.6 Sol、Terra、Luna、無料のGPT-5-Nano、さらにClaude Opus 5.5、Gemini、Grok、DeepSeekを1つのアカウントでまとめて使えます。これは聞こえる以上に重要です。上のベンチマークが示すとおり、すべてで勝つ単一のモデルは存在しません。だからこそ、同じ質問を2つのモデルに投げて良いほうの答えを採用できることは、いちばん新しい名前を追いかけるより価値があります。この議論の詳しい版はどのAIモデルが本当に賢いのかを、GPTの系譜がここに至った背景はGPT-5の解説をご覧ください。

よくある質問

GPT-6 Astraとは何ですか?

GPT-6 AstraはOpenAIのフラッグシップAIモデルで、2026年9月3日にGPT-5.6 Solの後継として公開されました。コンピューター操作、ソフトウェア開発、深いリサーチ、文書作成といった長い多段階の作業向けに作られており、コンテキストウィンドウは約105万トークンです。

GPT-6 Astraは無料ですか?

いいえ。GPT-6 Astraは有料のChatGPTプランとOpenAI APIで利用できます。無料ティアはなく、無料のChatGPTアカウントが利用できるようになるかどうかもOpenAIは発表していません。

GPT-6 AstraのAPI料金はいくらですか?

標準料金は入力100万トークンあたり10ドル、出力100万トークンあたり50ドルで、キャッシュ済み入力は100万トークンあたり1ドルです。入力が272,000トークンを超えるリクエストは長文コンテキスト料金に移り、100万トークンあたり入力およそ20ドル、出力75ドルになります。

GPT-6 Astraのコンテキストウィンドウはどれくらいですか?

入力で約105万トークン、1回の応答で最大128,000トークンの出力です。OpenAIは512Kトークンまで100%の検索精度、512Kから1Mの帯域では96.3%と報告しています。

GPT-6 AstraはGPT-5.6 Solよりどれくらい優れていますか?

OSWorld 2.0のコンピューター操作で65.7%に対し72.6%を記録し、タスク完了はおよそ47%速くなっています。FrontierMath Tier 4は83.0%から97.6%に上がり、不整合な結果の割合は18.8%から3.4%に下がりました。

GPT-6 AstraはAGIですか?

見解は一致していません。OpenAIの社長はこのリリースをAGIの到来と結びつけましたが、AstraはHumanity's Last ExamでClaude Fable 5.1に57.2%対65.0%で及ばず、ARC-AGI-3のスコアも状態を保持する環境がなければ99.9%から17%〜63%まで落ちます。汎用知能というより、エージェント能力の大きな前進と捉えるのが妥当です。

Omni AIでGPT-6 Astraを使えますか?

はい。GPT-6 AstraはOmni AIのProプランで利用できます。GPT-5.6 Sol、Terra、Luna、無料のGPT-5-Nano、さらにAnthropic、Google、xAI、DeepSeekのモデルと並んで選べます。会話の途中で切り替えても、スレッド全体がそのまま引き継がれます。

AIアプリの切り替えはもうやめよう

20以上のAIモデル、画像生成、動画作成など——すべて無料ダウンロード。

ブログ一覧へ戻る