GPT-6 Astraは米国時間2026年9月3日に公開され、APIのモデルIDは gpt-6-astra、標準料金は100万トークンあたり入力$10.00・出力$50.00、コンテキストウィンドウは1.05M、最大出力は128Kトークンです。gpt-5.6-sol(入力$4.00・出力$20.00)と比べるとトークン単価は2.5倍で、さらに reasoning.effort の none が使えない、ツール呼び出しにResponses APIが必須になる、といった実装側の変更が入ります。この記事は2026年9月4日時点の公式ドキュメントだけを根拠に、確定したスペックと料金、そして gpt-5.6-sol からの移行手順を実装目線でまとめたものです。
発表前にやっておく準備の話はAstra(GPT-6)発表前に開発者がやる準備5点に書きました。この記事は「発表されたので、実際にコードをどう直すか」に絞ります。背景(Preparedness FrameworkのCritical指定、安全策の強化)はGPT-6(Astra)発表の速報記事を参照してください。いつから・どのプランで・いくらで使えるかの全体像は、姉妹メディアのGPT-6 Astraとは|いつから使える?提供状況と料金に1ページで整理しています。
確定したスペック:モデルID・コンテキスト・カットオフ
OpenAIのモデル一覧に記載されている gpt-6-astra の仕様は次のとおりです。公式の説明文は「Our most capable model, built for the hardest end-to-end work」で、旗艦モデルの位置づけになっています。
| 項目 | gpt-6-astra | gpt-5.6-sol |
|---|---|---|
| モデルID | gpt-6-astra | gpt-5.6-sol(エイリアス gpt-5.6) |
| コンテキストウィンドウ | 1.05M | 1.05M |
| 最大出力 | 128Kトークン | 128Kトークン |
| 知識カットオフ | 2026年4月30日 | 2026年2月16日 |
| reasoning effort | low / medium / high / xhigh / max | none / low / medium / high / xhigh / max |
| ツール | Functions、Web search、File search、Computer use | |
実装で効いてくる差は2つだけです。ひとつは知識カットオフが2か月半新しいこと、もうひとつは Astraには none の reasoning effort が存在しないことです。Reasoningガイドには、Responsesの reasoning.effort またはChat Completionsの reasoning_effort に none を指定するとHTTP 400が返ると明記されています。コンテキスト長と最大出力はSolと同じなので、チャンク分割やトークン上限まわりのロジックはそのまま流用できます。

料金:標準は入力$10.00・出力$50.00、長コンテキストは272Kトークン超から
公式の料金ページは、短コンテキストと長コンテキストで別料金の2段構成です。100万トークンあたりの標準(Standard)処理の単価は次のとおりです。
| モデル / 区分 | 入力 | キャッシュ入力 | キャッシュ書き込み | 出力 |
|---|---|---|---|---|
| gpt-6-astra(短コンテキスト) | $10.00 | $1.00 | $12.50 | $50.00 |
| gpt-6-astra(長コンテキスト) | $20.00 | $2.00 | $25.00 | $75.00 |
| gpt-5.6-sol(短コンテキスト) | $4.00 | $0.40 | $5.00 | $20.00 |
| gpt-5.6-sol(長コンテキスト) | $8.00 | $0.80 | $10.00 | $30.00 |
| gpt-5.6-terra(短コンテキスト) | $2.00 | $0.20 | $2.50 | $12.00 |
| gpt-5.6-luna(短コンテキスト) | $0.20 | $0.02 | $0.25 | $1.20 |
長コンテキスト料金が適用される条件は、モデルページに明記されています。入力トークンが272Kを超えるプロンプトは、リクエスト全体が入力・キャッシュ料率2倍、出力1.5倍で課金されるという仕様です。つまり272Kを1トークンでも超えた瞬間、そのリクエストの出力分まで割増になります。長い履歴を無圧縮で持ち回す設計では、コンパクションや履歴の切り詰めを入れるかどうかが、そのまま請求額の段差になります。
キャッシュ書き込みは、キャッシュされていない入力単価の1.25倍で課金されます(Astraなら短コンテキストで$12.50)。キャッシュヒットは$1.00なので、同じプレフィクスを何度も使い回す設計ほど効きます。
なお gpt-5.6-sol の料金には「プロモーション価格は少なくとも2026年11月21日まで」という注記が付いています。Sol据え置きで運用する前提のコスト計画は、11月以降の値上げ余地を織り込んでおく必要があります。
もうひとつの注意点として、2026年3月5日以降にリリースされたモデルのうちデータレジデンシー対象のものは、リージョナル処理エンドポイントで10%上乗せされます。入出力のモダリティはテキストが入力・出力、画像は入力のみで、音声と動画は非対応です。
Batch・Flex・Fast modeの実額:半額と2倍
処理モードを変えると単価がそのまま動きます。gpt-6-astra の100万トークンあたりの単価は次のようになります。
| 処理モード | 入力(短) | 出力(短) | 入力(長) | 出力(長) |
|---|---|---|---|---|
| Standard | $10.00 | $50.00 | $20.00 | $75.00 |
| Batch | $5.00 | $25.00 | $10.00 | $37.50 |
| Flex | $5.00 | $25.00 | $10.00 | $37.50 |
| Fast mode | $20.00 | $100.00 | $40.00 | $150.00 |
BatchとFlexは標準の半額、Fast modeは2倍です。Fast modeは発表記事で「標準処理の最大2倍の速度」と説明されていますが、Astraの利用ガイドにはAstraのfast modeにレイテンシSLAは付かないと書かれています。加えてEUデータレジデンシーではAstraのFast modeが使えず、標準処理を使う必要があります。2026年7月30日にPriority processingがFast modeへ改称され、service_tier は "priority" と "fast" のどちらでも受け付けます。
夜間バッチや非同期の集計処理をAstraへ寄せるなら、まずBatchで組むほうが素直です。Batch APIでのコスト圧縮の考え方はBatch APIでAIコストを半減する方法にまとめています。

コスト試算例:同じトークン量ならSolの2.5倍
以下は試算例(実測値ではありません)です。前提は「1リクエストあたり入力50,000トークン(うち40,000トークンがキャッシュヒット)、出力5,000トークン、短コンテキスト単価、1日1,000リクエスト」。キャッシュ書き込み分は含めていません。
| 内訳 | gpt-6-astra | gpt-5.6-sol |
|---|---|---|
| 非キャッシュ入力 10,000トークン | $0.100 | $0.040 |
| キャッシュ入力 40,000トークン | $0.040 | $0.016 |
| 出力 5,000トークン | $0.250 | $0.100 |
| 1リクエスト合計 | $0.390 | $0.156 |
| 1日1,000リクエスト | $390.00 | $156.00 |
計算式は「トークン数 ÷ 1,000,000 × 単価」で、単価は前掲の公式料金表の値です。単純にトークン数を据え置くと2.5倍になります。ただしOpenAIはAstraの利用ガイドで「複数の評価で、より少ない出力トークンでより強い結果を出し、トークン単価が高いにもかかわらず1タスクあたりの推定APIコストは従来モデルより低い」と説明しています。つまり実際の請求額は、出力トークンがどれだけ減るかで変わります。移行判断は単価表ではなく、自分の評価セットを両モデルで流したときの1タスクあたりの総トークン数で行ってください。トークンの可視化と削減の考え方はAIエージェントのコスト最適化7原則が使えます。
移行手順:公式チェックリストの6項目
Astraの利用ガイドには「Update API and model parameters」という移行チェックリストがあります。要点は6つです。
- モデル指定:
modelをgpt-6-astraにする。 - reasoning effort:いま
noneかminimalを使っているならlowから始めて結果を比較する。それ以外は現在の実効値を維持する。 - ツール呼び出し:Responses APIを使う。AstraはChat Completionsもサポートするが、ツール呼び出しにはResponsesが必要。
- 非対応パラメータの削除:
temperature、top_p、top_logprobsを外す。Chat Completionsではlogprobsも、Responsesではincludeからmessage.output_text.logprobsを外す。 - Fast mode:EUデータレジデンシーでは標準処理を使う。
- プロンプトキャッシュ:GPT-5.5以前からの移行では
prompt_cache_retentionをprompt_cache_options.ttl("30m")へ置き換える。

最小の呼び出しは、公式ドキュメントのサンプルと同じくResponses APIで済みます。
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-6-astra",
reasoning={"effort": "low"},
input=[{"role": "user", "content": prompt}],
)
print(response.output_text)
curlでも同じです。
curl https://api.openai.com/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-d '{
"model": "gpt-6-astra",
"reasoning": {"effort": "low"},
"input": [{"role": "user", "content": "..."}]
}'
モデルIDをコードに直書きしていると、この差し替えが全ファイル横断の作業になります。設定値として外に出しておく設計はモデル非依存・フォールバック構成で書いたとおりです。破壊的変更の直し方という意味では、Claude Fable 5.1 API移行ガイドと同じ手順が使えます。
Astraだけの新機能:非同期ツール呼び出しと途中での努力量変更
Astraで新しく使えるようになった機能のうち、エージェント実装に直接効くのは3つです。
非同期ツール呼び出し(Async tool calling)。関数ツールやカスタムツールに async: true を設定すると、アプリケーション側がツールを実行している間もモデルは推論を続けたり、別のツールを呼んだり、リクエストのうち独立した部分に答えたりできます。結果は元の call_id で返します。ツールの実行と待ち状態の管理はアプリケーション側の責任のままです。
ターン途中のステアリング(Mid-turn steering)。WebSocket接続では、Astraが作業している最中に修正や要件変更を送っても、Responses APIが完了済みの作業を保持したまま更新を継続分に含めます。
会話の途中でreasoning effortを変える。configuration_update という入力アイテムを差し込むと、リクエストレベルの reasoning.effort を書き換えずに努力量だけ変更できます。プロンプトの前置きが変わらないので、プロンプトキャッシュが効いたままになるのが利点です。
{
"type": "configuration_update",
"reasoning": {
"effort": "high"
}
}

この機能はAstraの標準・単一エージェントモードでのみ対応で、変更できるのはreasoning effortだけです。configuration_update を隣接して2つ並べるとAPIが拒否します。また自動コンパクションや自動切り詰めとは併用できません。キャッシュ設計そのものの考え方はプロンプトキャッシュ比較2026を参照してください。
1.05Mコンテキストで何が変わるか
コンテキスト長の数字自体はSolと同じ1.05Mですが、長い文脈での精度は公式ベンチマークで差が付いています。発表記事の表では、OpenAI MRCR v2の8-needle 512K〜1Mでスコア96.3%(Solは73.8%)、256K〜512Kでは100.0%(同91.5%)です。
| 評価 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|
| OpenAI MRCR v2 8-needle 512K-1M | 96.3% | 73.8% |
| OSWorld 2.0(オフラインセット、部分点) | 72.6% | 65.7% |
| Terminal-Bench 4.0 | 57.9% | 37.3% |
| FrontierMath Tier 4(v2) | 97.6% | 83.0% |
| 社内ハルシネーション評価(低いほど良い) | 4.2% | 12.2% |
スコアはいずれも「任意の努力量での最大値」で、研究環境またはAPI経由の測定値だと注記されています。Codexを使っている場合は、Astraに合わせてハーネス側も更新され、コンテキストウィンドウが埋まったときに要約で潰さず「メモ」として持ち越し、以前のコンテキストを検索できる仕組みが入りました。config.toml で有効にできる実験的機能で、数週間のうちにAstraでの既定になると説明されています。長い履歴を圧縮せずに持ち回す設計、あるいは大きなリポジトリを丸ごと読ませる設計は、Astraのほうが素直に組めます。レイテンシ面では、OSWorld 2.0のシミュレーションで1タスクあたりの所要時間がSolより約47%短い(約40分に対して約75分)と説明されています。
挙動が変わる4点:プロンプト側の調整が必要
Astraの利用ガイドは、モデルの振る舞いについて4つの注意点を挙げています。単価やパラメータより、こちらのほうが移行時の体感差になります。
- 主体性と完遂:結果が大きく変わりうる場面では、以前のモデルが仮定で進めたところでも質問してくることがある。自律的に進めてほしい場合はプロンプトで明示する。
- 指示追従:長い指示に強くなった一方で、文脈中の情報に敏感になった。スキルファイルや
AGENTS.mdに曖昧な記述や矛盾があると、作業を早めに止めることがある。公式はモデルが読めるファイルの監査を強く推奨している。 - 文体:リスト・表・Markdownを多用する傾向がある。散文で出したいアプリケーションは書式を明示する。
- サブエージェント委譲とテスト:委譲は想定より少なめ、コーディングでは検証が手厚めになる。どちらもプロンプトで調整幅がある。

公式ガイドには各項目に対する推奨プロンプトの原文が載っています。移行時はまずそれをそのまま入れて挙動を見るのが早いです。Codexを使っているなら、OpenAI Docsスキルを入れて $openai-docs migrate this project to GPT-6 Astra と指示すると、ガイド記載の変更を適用させることもできます。
安全側の変更:APIではタスクが止まる
安全性概要によると、Astraは「これまでに広く展開した中で最も高性能なモデル」で、Preparedness Frameworkのサイバーセキュリティ能力でCritical水準に達した最初のモデルです。実装側に効くのは、外部提供におけるツール利用推論のすべてにミスアライメント監視が入った点です。
この監視は分類器がモデルの推論と行動を検査し、認可されていない挙動を自動で止めます。発表記事には、ChatGPTやCodexでタスクが一時停止した場合は続行前に確認を求められることがあるが、APIではタスクが停止すると書かれています。長時間動くエージェントを組んでいるなら、停止したレスポンスを受けたときに途中状態を保存して人の確認に回す経路を先に用意しておくべきです。
アライメント評価では、54,000件を超える社内Codexタスクを使ったシミュレーションで、高深刻度のミスアライメント挙動のフラグ数がSolの約半分だったと報告されています。一方で、監視のしやすさ(monitorability)はSolより低下したとも明記されています。Astraの安全性をめぐる経緯はOpenAI Astraの正体|数学10問証明と6日後の急停止にまとめています。
提供状況:APIとChatGPTでどこまで公式に言えるか
公式ドキュメントとブログの記載を整理すると、9月4日時点の提供状況は次のとおりです。
- 公開当日はTrusted Access Programに参加する企業向けにロールアウト。APIおよびPlus・Pro・Business・Enterpriseの各プランでの提供は「今後数日のうちに(in the coming days)」。
- APIでは
gpt-6-astraとして提供され、Amazon Bedrock経由でも利用できる。 - ChatGPT側の利用は既存のサブスクリプション枠に含まれ、追加分はクレジット購入。Pro・Business・EnterpriseではGPT-6 Astra Proも使える。Enterpriseはワークスペース管理者による有効化が必要で、開始時点では既定で無効。
- 対象となるAPI顧客はZero Data Retentionに対応。
ChatGPTのリリースノートにも米国時間9月3日付でAstraの項目が立っており、「一部の組織にロールアウト中。Astraはまだ一般提供ではない。より広い提供は今後数日のうちを予定」と書かれています。一般提供の具体的な日付は9月4日時点で公表されておらず、公式に確認できていません。「何日から使える」と社内に案内する前に、ヘルプセンターとプラットフォームのモデル一覧を直接見てください。
移行でやりがちな失敗パターン
- ❌ Solで使っていた
reasoning_effort: "none"をそのまま流用する → HTTP 400で落ちる。⭕lowから始めて出力品質とトークン量を比較する。 - ❌ Chat Completionsのままツール呼び出しを続ける → ⭕ ツールを使う経路はResponses APIへ移す。テキスト生成だけならChat Completionsのままでも動く。
- ❌
temperatureやtop_pを残したままモデルIDだけ差し替える → ⭕ 非対応パラメータを先に削除してからモデルを切り替える。 - ❌ EUデータレジデンシー構成で
service_tier: "fast"を指定する → ⭕ 標準処理を使う。 - ❌ 会話の途中でリクエストレベルの
reasoning.effortを書き換える → プロンプトの前置きが変わりキャッシュが効かなくなる。⭕configuration_updateを使う。 - ❌ 単価表だけを見て「2.5倍だから見送り」と判断する → ⭕ 自分の評価セットで1タスクあたりの総トークン数を測ってから決める。
よくある質問
GPT-6 Astraとは何ですか?
OpenAIが米国時間2026年9月3日に公開した最新の旗艦モデルです。APIのモデルIDは gpt-6-astra、公式の説明は「最も高性能なモデル、最も難しいエンドツーエンドの作業のために作られた」です。コンピュータ操作、ブラウジング、ソフトウェア開発、科学、専門業務で最先端の性能だとされています。
GPT-6 AstraはいつからAPIで使えますか?
公開当日はTrusted Access Programの企業向けで、APIと各プランでの提供は公式に「今後数日のうちに」と書かれています。ChatGPTのリリースノートにも「まだ一般提供ではない」と明記されており、具体的な日付は9月4日時点で公表されていません。
料金はgpt-5.6-solよりどれくらい高いですか?
標準処理の短コンテキストで、入力が$4.00から$10.00へ、出力が$20.00から$50.00へ(いずれも100万トークンあたり)。単価では2.5倍です。ただしOpenAIは出力トークンが減ることで1タスクあたりの推定コストは従来モデルより低いと説明しているため、実額は自分のワークロードで測る必要があります。
長コンテキストの料金はどこから適用されますか?
入力トークンが272Kを超えるプロンプトが対象です。その場合、リクエスト全体が入力・キャッシュ料率2倍、出力1.5倍で課金されます。272K以下なら短コンテキストの単価(入力$10.00・出力$50.00)です。
既存のChat Completions実装はそのまま動きますか?
テキスト生成だけならChat Completionsでも動きますが、ツール呼び出しにはResponses APIが必要です。また temperature、top_p、top_logprobs、Chat Completionsの logprobs は非対応なので削除が要ります。
Astraに切り替えるとエージェントが途中で止まることはありますか?
あります。外部提供のツール利用推論にはミスアライメント監視が入っており、公式は「ChatGPTやCodexでは確認を求められることがあるが、APIではタスクが停止する」と説明しています。停止時に途中状態を保存して人の確認へ回す設計を先に入れておくのが安全です。
まとめ|今日やる3つ
- 非対応パラメータ(
temperature、top_p、top_logprobs)を削り、ツール経路をResponses APIへ寄せる。 - 評価セットを
gpt-5.6-solとgpt-6-astraの両方で流し、スコアと1タスクあたりの総トークン数を並べて比較する。単価だけで決めない。 - スキルファイルと
AGENTS.mdを読み直し、曖昧な記述や矛盾する指示を消す。Astraはここに敏感で、作業が早めに止まる原因になる。
この記事を読んで導入イメージが固まってきた方へ
UravationではAIエージェント導入の研修・コンサルを行っています。
参考・出典
- Models – OpenAI API(モデルID、コンテキスト、最大出力、カットオフ、ツール、reasoning effort)
- Pricing – OpenAI API(Standard・Batch・Flex・Fast modeの単価、Solのプロモーション価格の期限、リージョナル処理の10%上乗せ)
- Using GPT-6 Astra – OpenAI API(移行チェックリスト、非同期ツール呼び出し、mid-turn steering、挙動の注意点)
- Reasoning – OpenAI API(noneでHTTP 400、configuration_updateの制約)
- GPT-6 Astra: A new generation of intelligence(提供範囲、ベンチマーク表、Fast modeの速度、レイテンシ)
- Safety overview: GPT-6 Astra(Critical水準、ミスアライメント監視、54,000件のCodexタスクシミュレーション。OpenAIのニュース一覧で米国時間2026年9月3日付)
- GPT-6 Astra モデルページ(272Kトークン超の課金ルール、キャッシュ書き込み1.25倍、対応モダリティとエンドポイント)
- ChatGPT — Release Notes(米国時間2026年9月3日「Introducing GPT-6 Astra」・一般提供前である旨)
- Path to Astra: critical capabilities and frontier safeguards(2026年9月1日・発表前の安全策)
