GPT-5.6の料金体系解説:APIコスト、ChatGPTプラン、モデル階層
Sol、Terra、LunaのGPT-5.6料金体系を理解する。現在のトークン料金、キャッシュ入力、長文コンテキストコスト、ChatGPTアクセス、および結果あたりのコストモデリングを含む。

GPT-5.6の価格設定は、入力トークンと出力トークンのレートに単純化するとシンプルに見えます。実際のコストは、モデル階層、推論の労力、コンテキスト長、キャッシュの動作、そして受け入れ可能な結果を得るために必要な試行回数という5つの変数によって形成されます。
また、最近の落とし穴もあります。OpenAIはGPT-5.6の価格を当初のリリース後に変更し、TerraとLunaの値下げやSolのプロモーション価格を含めました。現在のモデルページを確認せずにリリース時の表をコピーした記事は、すでに間違っています。
このガイドは、2026年9月3日時点のOpenAI公式ページで確認された価格設定を使用しています。恒久的な料金表ではなく、計算の枠組みとして扱ってください。
現在のGPT-5.6 API料金
| モデル | 100万トークンあたりの入力 | 100万トークンあたりのキャッシュ入力 | 100万トークンあたりの出力 | ポジショニング | | GPT-5.6 Sol | $4.00 | $0.40 | $20.00 | フラッグシップ複雑作業 | | GPT-5.6 Terra | $2.00 | $0.20 | $12.00 | 知能とコストのバランスが取れたモデル | | GPT-5.6 Luna | $0.20 | $0.02 | $1.20 | コスト重視の大量処理 |
OpenAIの現在のSolページには、$4/$20の価格設定は少なくとも2026年11月21日までプロモーション価格であると記載されています。同社はプロモーション料金を延長、変更、または終了する可能性があるため、制作予算には見直し日を含めるべきです。
トークン課金の仕組み
入力トークン
入力には、リクエストに含まれる指示、ユーザーコンテンツ、以前の会話、取得された証拠、モデルに返されたツール結果が含まれます。すべての呼び出しで繰り返される長いシステムプロンプトは、大きなコスト要因になる可能性があります。
出力トークン
出力は生成されたテキストであり、入力よりもはるかに高い価格設定がされる可能性があります。レビュアーが3つ必要とする場合に10の代替案を求めたり、対象を絞った修正ではなく全文書き換えを要求すると、使用量とレビューの負担の両方が増加します。
キャッシュされた入力
プロンプトキャッシングは安定したプレフィックスに報酬を与えます。多くのリクエストが同じポリシー、スキーマ、製品知識を共有する場合、そのプレフィックスをバイト単位で安定させておくことで、繰り返し入力のコストを削減できます。GPT-5.6は明示的なキャッシュブレークポイントをサポートしており、自動キャッシングも引き続き利用可能です。
同じように見えるプロンプトでも、必ずしもキャッシュヒットするとは限りません。動的なタイムスタンプ、例の並び替え、リクエストの早い段階に配置されたユーザー固有のコンテンツは、再利用を減少させる可能性があります。実際のAPIレスポンスからキャッシュされたトークンを測定してください。
キャッシュ書き込み
現在のGPT-5.6のガイダンスでは、キャッシュ書き込みは非キャッシュ入力レートの1.25倍で課金され、読み取りは割引されるとされています。したがって、キャッシュは投資であり、安定したプレフィックスが十分な回数再利用された場合に効果を発揮します。
基本コスト計算式
単純なテキストリクエストの場合:
コスト = 入力トークン ÷ 1,000,000 × 入力レート + 出力トークン ÷ 1,000,000 × 出力レート
1回のTerra呼び出しで、キャッシュされていない入力トークン20,000トークンを使用し、3,000トークンの出力を生成すると仮定します:
- 入力: 20,000 / 1,000,000 × $2 = $0.04
- 出力: 3,000 / 1,000,000 × $12 = $0.036
- 推定テキストトークンコスト: $0.076
これはツール、再試行、および特別な処理費用を除きます。
ここで、入力トークンのうち15,000がキャッシュ読み取りとして適格であると仮定します:
- 5,000 アンキャッシュド入力: $0.01
- 15,000 キャッシュされた入力: $0.003
- 3,000 出力: $0.036
- 推定合計: $0.049
この例は、出力の規律とキャッシュ設計が、見かけ上の入力価格と同じくらい重要になり得る理由を示しています。
長文脈の価格設定が方程式を変える可能性
GPT-5.6 Solモデルのページには、105万トークンのコンテキストウィンドウが記載されていますが、272,000入力トークンを超えるプロンプトは、リクエスト全体に対して入力レートの2倍、出力レートの1.5倍で課金されることも記載されています。
これにより、重要な設計上の閾値が生まれます。リポジトリ全体やドキュメントアーカイブを1つのリクエストにまとめると、検索と複数の小さな呼び出しを組み合わせるよりもコストが高くなる可能性があります。非常に長いコンテキストを使用する前に、次の点を検討してください。
- すべての文書が同じ決定に影響を与えるのでしょうか?
- 検索はより小さな証拠セットを選択できますか?
- 安定した背景素材はキャッシュ可能ですか?
- 段階的な在庫管理と統合により、トレーサビリティは向上しますか?
- 閾値を超えることで、受け入れが乗数に見合うほど十分に向上するのでしょうか?
大きなコンテキストは能力であり、入力を最大化するための推奨ではありません。
推論の労力とコスト
GPT-5.6はAPIでnone、low、medium、high、xhigh、maxをサポートしています。高い推論レベルはより多くのトークンと時間を使用する可能性があります。経済的に正しい設定は必ずしも最も低いものではありません。難しいタスクは、低い労力での試行が何度も失敗するのを避けられる場合、高い労力でより安価になることがあります。
努力レベルを評価するには、以下を使用します。
受け入れられた出力あたりのコスト = モデルとツールの総コスト / レビューを通過した出力の数
低コストの設定が0.03ドルでも、出力の50%しか合格しない場合、再試行やレビュー前の合格結果あたりの直接モデルコストは少なくとも0.06ドルになります。合格率95%の0.05ドルの設定の方が、運用コストが安くなる可能性があります。
高速モード、バッチ処理、ツール
OpenAIは、GPT-5.6 SolのFastモードが、より高い価格でより高速なAPI処理を提供できると報告しています。これは、このモデルのPriority Processingを置き換えるものです。レイテンシに測定可能な価値がある場合(インタラクティブなコーディング、時間に敏感な操作、または応答を待つ人間のワークフロー)に使用してください。単に高速の方が良さそうだからという理由では使用しないでください。
バッチ処理は非同期ワークロードに適している場合がありますが、ウェブ検索、コンピュータ利用、その他のツールには別途料金が発生する可能性があります。ツールのループや失敗した呼び出しを含む、完全なリクエストパスを常に見積もってください。
ChatGPTのプランはトークンバンドルではありません
ChatGPTのサブスクリプションアクセスは、APIトークンレートと直接比較すべきではありません。サブスクリプションは、プラン制限、利用ポリシー、ワークスペースコントロールに従った製品機能とモデルオプションへのアクセスを提供するものであり、互換性のあるAPI残高を生み出すものではありません。
現在の公式ガイダンスでは次のように述べられています:
- PlusにはGPT-5.6 Sol MediumおよびHighが含まれます。
- Pro、Business、Enterpriseには、Medium、High、Extra High、Proが含まれます。
- 無料でGoは日常のチャットや思考にGPT-5.6 Lunaを使用します。
- 制限は、プランや管理ワークスペースの設定によって異なる場合があります。
人間がモデルと直接やり取りする場合はChatGPTを使用してください。ソフトウェアがプログラム可能で計測可能なアクセスと運用制御を必要とする場合はAPIを使用してください。
ユニットエコノミクスによるティアの選択
Luna: ボリューム最適化と検証
分類、抽出、メタデータ、最初の下書き作成など、正しさを低コストで確認できるタスクにはLunaを使用してください。低料金で、フラッグシップモデルでは経済的に難しい実験をサポートできます。
Terra: バランスの取れた生産に最適化
Terraは、繰り返し発生する専門業務のための有用なベースラインです。Lunaと比較して例外処理を減らしつつ、Solよりも低コストを維持できる可能性があります。
Sol: コストのかかる判断と難しいケースに最適化
失敗のコストがトークンコストを支配する場合にSolを使用する:最終合成、複雑なエージェント作業、難しいコード変更、微妙なデザインレビュー、または影響の大きい例外。
アニメーションワークフローのコスト設計
アニメーションパイプラインは、すべてのステージを同じ推論階層に送るべきではありません。
- Lunaはアセット名の正規化、シーンのタグ付け、メタデータバリアントの作成が可能です。
- Terraはシーンのブレイクダウン、キャラクター概要、制作プロンプトを作成できます。
- Sol は長い物語の矛盾点を監査したり、複雑な最終計画をレビューすることができます。
- Elser AIは、作成されたブリーフが承認された後、専門的なキャラクター、ストーリーボード、アニメーション、音声、編集のワークフローを実行できます。
この分離により、高価な推論呼び出しが日常的なフォーマット処理に費やされることを防ぎ、言語モデルのトークン価格にメディア生成が含まれているかのように装うことを避けます。
月次コスト予測の構築
以下の列を持つテーブルを作成してください。
- タスクタイプ。
- 月間リクエスト量。
- 選択されたモデルと労力。
- 平均未キャッシュ入力トークン数。
- 平均キャッシュ入力トークン数。
- 平均出力トークン数。
- ツール呼び出しと料金。
- 再試行率。
- 人間による審査議事録。
- 受入率。
ベース、高ボリューム、キャッシュ効率が低いシナリオを実行します。プロモーション価格終了に対する感度分析ケースを追加します。ロールアウト中は毎週実際の使用状況を確認し、観測されたトークン数(推定ではない)で予測を更新します。
FAQ
GPT-5.6 Solの料金はいくらですか?
2026年9月3日に確認したところ、公式モデルページには、入力トークン100万件あたり4ドル、キャッシュ済み入力トークン100万件あたり0.40ドル、出力トークン100万件あたり20ドルと記載されています。プロモーション価格は、少なくとも2026年11月21日まで適用されるとされています。
GPT-5.6 Lunaは常に最も安い選択肢ですか?
このファミリーの中で最も低い掲載トークン料金ですが、リトライ、レビュー、エラーコストにより、受け入れられた結果あたりでは別のモデルの方が安くなる場合があります。
ChatGPTのサブスクリプションにはAPIの利用が含まれていますか?
ChatGPTとAPIの課金は別々の製品として扱います。APIリクエストはAPI料金に基づいて計測され、サブスクリプションアクセスはChatGPTプランの制限と機能に従います。
プロンプトキャッシュは自動的に行われますか?
自動キャッシュが利用可能で、GPT-5.6は明示的なキャッシュブレークポイントもサポートしています。実際の節約額は、プレフィックスの安定性と再利用に依存します。
画像や動画生成のコストはここに含まれていますか?
いいえ、これらの料金はGPT-5.6のテキストトークン使用量を対象としています。専門的なメディアエンドポイントやサードパーティの制作ツールには、それぞれ独自の価格設定があります。
結論
GPT-5.6の価格設定は、システムの問題として管理するのが最適です。タスクのリスクに応じて階層を選択し、評価を通じて推論の労力を設定し、キャッシュ再利用のための安定したプレフィックスを設計し、不要な長文脈の閾値を避け、受け入れられた結果あたりのコストを測定します。
最低トークン価格は有用です。完了し承認された作業のコストが低いことが実際に重要です。

















































































