GPT-5.6には、能力を重視するSol、日常業務とのバランスを取るTerra、速度と低コストを重視するLunaがあります。API料金は2026年7月30日に改定され、Terraは20%、Lunaは80%値下げされました。
この記事では、OpenAIの公式発表と現行料金表を基に、3モデルの位置づけ、現在のAPI料金、処理モードによる違い、用途別の選び方を整理します。
結論:難しい仕事はSol、日常業務はTerra、大量処理はLuna
モデル名だけで上下を決めるのではなく、失敗時の手戻り、処理量、待ち時間、予算を合わせて選ぶのが基本です。
| モデル | 公式の位置づけ | 検討しやすい用途 | 標準・短文脈の入力/出力 |
|---|---|---|---|
| GPT-5.6 Sol | フラッグシップ | 複雑な推論、曖昧な課題、高度なコーディング、重要な判断材料の作成 | 5ドル/30ドル |
| GPT-5.6 Terra | 能力とコストのバランス | レポート、文書分析、日常的な開発・業務処理 | 2ドル/12ドル |
| GPT-5.6 Luna | 最速・最も低価格 | 分類、抽出、ルーティング、サポート、大量の定型処理 | 0.20ドル/1.20ドル |
料金は100万トークン当たり。上表は標準処理・短文脈の非キャッシュ入力と出力です。性能の必要条件は用途ごとに異なるため、重要な導入では同じ評価データで品質と総費用を確認してください。
2026年7月30日にTerraとLunaのAPI料金が値下げ
GPT-5.6は2026年7月9日に一般提供が始まりました。その後、OpenAIは7月30日にTerraを20%、Lunaを80%値下げしました。Solの標準料金は変わっていません。
| モデル | 提供開始時の入力/出力 | 7月30日以降の入力/出力 | 変更 |
|---|---|---|---|
| Sol | 5ドル/30ドル | 5ドル/30ドル | 変更なし |
| Terra | 2.50ドル/15ドル | 2ドル/12ドル | 20%値下げ |
| Luna | 1ドル/6ドル | 0.20ドル/1.20ドル | 80%値下げ |
古い比較記事や提供開始時の発表には改定前の価格が残る場合があります。実装前には、必ず現行のAPI料金ページを確認してください。
現行の標準API料金
OpenAIの料金表では、短文脈と長文脈、非キャッシュ入力、キャッシュ済み入力、キャッシュ書き込み、出力が分かれています。
| モデル | 短文脈入力 | キャッシュ済み入力 | キャッシュ書き込み | 短文脈出力 |
|---|---|---|---|---|
| Sol | 5ドル | 0.50ドル | 6.25ドル | 30ドル |
| Terra | 2ドル | 0.20ドル | 2.50ドル | 12ドル |
| Luna | 0.20ドル | 0.02ドル | 0.25ドル | 1.20ドル |
長文脈では、入力と出力の単価が短文脈より高くなります。たとえばSolは入力10ドル・出力45ドル、Terraは入力4ドル・出力18ドル、Lunaは入力0.40ドル・出力1.80ドルです。長い資料を扱う場合は、モデル単価だけでなく文脈区分も確認します。
Standard・Batch・Flex・Fastの違い
| 処理方法 | 短文脈料金の関係 | 確認ポイント |
|---|---|---|
| Standard | 基準料金 | 通常のオンライン処理 |
| Batch | Standardの50% | 即時応答が不要な一括処理向け |
| Flex | Standardの50% | 処理時間の変動を許容できる仕事向け |
| Fast | Standardの2倍 | 低遅延を優先。旧Priority Processingの後継 |
Fast modeは2026年7月30日にPriority Processingを置き換えました。既存のservice_tier: "priority"指定は互換性のためFastとして扱われ、service_tier: "fast"も使用できます。処理時間や利用条件は変わり得るため、料金だけでなく各モードの公式説明も確認してください。
簡易計算:50万入力・10万出力ならいくらか
標準・短文脈で、キャッシュを使わず50万入力トークンと10万出力トークンを処理する単純例です。
| モデル | 入力費用 | 出力費用 | 合計 |
|---|---|---|---|
| Sol | 2.50ドル | 3ドル | 5.50ドル |
| Terra | 1ドル | 1.20ドル | 2.20ドル |
| Luna | 0.10ドル | 0.12ドル | 0.22ドル |
実際の請求には、長文脈、キャッシュ、ツール利用、処理モード、データレジデンシーなどが影響します。この例はモデル間の概算比較です。
用途別の選び方
Sol:失敗時の手戻りが大きい複雑な仕事
複数条件をまたぐ分析、曖昧な要件からの設計、高度なコード変更など、品質不足による再作業が高くつく仕事ではSolから評価します。単価は高くても、少ない試行で完了できるなら総費用が下がる場合があります。ただし、公式ベンチマークだけで自分の用途の品質を保証するものではありません。
Terra:日常業務の基準候補
文書整理、レポート、定型的な開発、社内業務など、判断力とコストの両方が必要な用途の比較基準にしやすいモデルです。Solで作った評価基準を満たせるか確認し、品質が十分ならTerraへ移す方法があります。
Luna:大量・低遅延の定型処理
分類、抽出、ルーティングなど、処理単位が明確で件数が多い用途に向きます。安価でも誤りの影響が大きい処理へ無条件に使わず、信頼度の低い結果をTerraやSol、人の確認へ回す設計が必要です。
ChatGPT・ChatGPT Work・Codexでの利用
OpenAIの提供開始時の案内では、GPT-5.6はChatGPT、ChatGPT Work、Codex、APIで提供されています。ただし、選べるモデル、推論レベル、利用上限はプランと画面によって異なります。Plus以上のChatGPT Work・CodexではSol・Terra・Lunaの選択が案内され、FreeとGoではTerraが案内されています。
ChatGPTの契約料金とAPIの従量課金は別です。API料金表の「1M tokens」の単価を、ChatGPTの月額料金として読まないよう注意してください。
ChatGPTのFree・Go・Plus・Pro・Businessの月額、利用上限、年払い、データ利用の違いは、ChatGPT料金プラン比較で整理しています。
API導入前に確認したい6項目
- モデルID:
gpt-5.6-sol、gpt-5.6-terra、gpt-5.6-lunaを明示する。gpt-5.6エイリアスはSolへルーティングされる。 - 文脈区分:長文脈では単価が上がるため、入力資料の長さを確認する。
- キャッシュ:キャッシュ読み取りは安い一方、書き込みにも料金がある。
- 処理モード:即時性が不要ならBatchまたはFlex、遅延を減らす必要がある場合のみFastを比較する。
- 追加費用:Web searchやFile searchなどのツールは別料金が発生する場合がある。
- 地域処理:対象モデルのデータレジデンシー対応エンドポイントには10%の上乗せがある。
ChatGPT Workへの移行も確認
GPT-5.6をChatGPT Workで使う前に、旧ChatGPT agentから何が変わったのか、現在の提供状況、Chat・Work・Codexの違いをChatGPT agent終了とChatGPT Workへの移行ガイドで確認できます。Workの利用量とAPI料金は別の仕組みです。
公式情報
情報確認日
2026年8月1日
まとめ
GPT-5.6は、複雑な仕事向けのSol、日常業務向けのTerra、大量・低遅延処理向けのLunaという3段階です。7月30日の値下げ後は、標準・短文脈でTerraが入力2ドル/出力12ドル、Lunaが入力0.20ドル/出力1.20ドルです。モデル単価だけで決めず、自分の評価データで品質、再試行回数、処理時間、総費用を比較してください。
