---
title: "GPT-5.6とは｜Sol・Terra・Lunaの3モデルと新機能・料金を実装目線で解説"
url: "https://www.issoh.co.jp/tech/details/13357/"
published: 2026-07-09
updated: 2026-09-20
categories: ["AI"]
publisher: "株式会社一創"
---

# GPT-5.6とは｜Sol・Terra・Lunaの3モデルと新機能・料金を実装目線で解説

GPT-5.6は、OpenAIが2026年6月末に限定プレビューを開始した新しい大規模言語モデルのシリーズです。旗艦のSol、日常業務向けのバランス型Terra、高速・低コストのLunaという3モデルで構成され、Solには推論時間を最大化するmax推論エフォートと、複数のサブエージェントを動かすultraモードが加わりました。この記事では、3モデルの役割分担と提供時期、max推論エフォートやプロンプトキャッシュ刷新といった新機能、GPT-5.5からの性能差、1MトークンあたりのAPI料金、そして用途別にどのモデルを選び既存システムへどう組み込むかを、実装する立場から整理します。導入時の統制やリスク管理は別記事に譲り、本記事はモデルそのものと選定の判断に絞ります。

## まとめ：GPT-5.6はSol・Terra・Lunaの3層で用途とコストを分ける新モデル

GPT-5.6を一言で表すと、1つのモデルではなく「性能とコストの異なる3つの選択肢」です。最高性能を要る場面ではSol、通常の業務処理ではTerra、大量のリクエストをさばくならLunaと、用途で使い分ける前提で設計されています。Solだけに与えられたmax推論エフォートと、複数サブエージェントを並行させるultraモードが、高難度タスクの精度を押し上げる新機軸です。

実装で先に決めるべきは、精度とコストのどちらを優先するかです。API料金は1MトークンあたりでSolが入力5ドル・出力30ドル、Terraが2.5ドル・15ドル、Lunaが1ドル・6ドルと、モデル間で数倍の開きがあります（いずれも2026年7月の公開時点の発表値）。TerraはGPT-5.5級の性能をおおよそ半額で出せるため、まずTerraを既定に置き、精度が届かない処理だけSolへ上げる設計が費用対効果で合理的です。限定プレビューは2026年6月26日に始まり、一般提供は日本時間2026年7月10日が予定されています。

## GPT-5.6の基本構成｜Sol・Terra・Lunaの3モデルと提供時期

GPT-5.6は単一モデルの更新ではなく、性能帯の異なる3モデルを同時に出す構成をとります。まず各モデルの立ち位置と、いつから使えるのかを押さえます。

### Sol・Terra・Lunaの3モデルの役割分担と性能の位置づけ

3モデルは、性能とコストのトレードオフを段階で分けています。Solはシリーズ最上位で、最も難しい推論やコーディング、研究用途に向きます。Terraはその1つ下で、前世代のGPT-5.5に相当する性能を保ちつつ価格を抑えた日常業務向けです。Lunaは速度と価格を最優先した軽量モデルで、大量処理や単純なやり取りに使います。

| モデル   | 位置づけ    | 主な用途      |
| ----- | ------- | --------- |
| Sol   | 旗艦・最高性能 | 高難度の推論・研究 |
| Terra | バランス型   | 日常業務・一般用途 |
| Luna  | 高速・低コスト | 大量処理・軽量用途 |

GPT-5.6はいずれも大規模言語モデル（LLM）の系譜にあり、基盤となる仕組みや企業導入で見るべき観点は前世代から引き継いでいます。LLMそのものの構造や選定の考え方を先に押さえたい場合は、[大規模言語モデルの仕組みと企業導入の判断基準](https://www.issoh.co.jp/column/details/12962/)を読むと、3モデルの違いが理解しやすくなります。

### 米国政府との調整で始まった限定プレビューと一般提供の開始時期

提供の順序が通常のリリースと違います。GPT-5.6はまず2026年6月26日から、米国政府との調整のもとで一部の信頼できるパートナーに限定プレビューされました。サイバーセキュリティや生物学の領域で能力が向上しているため、広く開放する前に限られた相手で検証する段階を踏んだ形です。その後の一般提供は日本時間の2026年7月10日が予定されています。導入計画を立てる際は、限定プレビューと一般提供でアクセスできる範囲が違う点を前提にしてください。

## GPT-5.6の新機能｜max推論エフォート・ultraモードとキャッシュ刷新

GPT-5.6で加わった機能は、単なる精度向上ではなく「どこまで計算資源を注ぐか」を制御できるようにした点にあります。実装で効いてくる3つを順に見ます。

### max推論エフォートでSolだけに推論時間を最大限与える仕組み

推論エフォートは、モデルが答えを出す前にどれだけ考える時間を使うかを指定する設定です。GPT-5.6では新たに最上位のmaxが加わり、Solに対して従来より多くの推論時間を割り当てられます。難問ほど考える時間が精度に効くため、複雑なコード生成や多段の論理を要する問題でmaxが選択肢になります。ただしトークン消費と応答時間は増えるので、全リクエストに使うものではなく、精度が足りない処理へ限定して上げる使い方が現実的です。maxを使えるのはSolに限られます。

### ultraモードと複数サブエージェントによる並行処理の高速化

ultraモードは、1つのタスクを複数のサブエージェントに分けて並行処理させる仕組みです。大きな作業を分割し、それぞれを別のエージェントが担って結果を統合するため、単一の推論を長く回すより複雑な作業を速く仕上げられます。コーディングワークフローを評価するTerminal-Bench 2.1での成績は、Sol Ultraが91.9%。エージェント指向で複数の処理を束ねる設計は、単発の質問応答とは実装の考え方が変わります。AIエージェントの構成そのものを理解したい場合は、[AIエージェントの仕組みと業務への組み込み方](https://www.issoh.co.jp/column/details/12917/)が参考になります。

### プロンプトキャッシュの刷新による長時間処理でのコスト抑制効果

プロンプトキャッシュの仕様も刷新されました。明示的なキャッシュブレイクポイントを指定でき、キャッシュの寿命は最低30分が保証される仕様です。同じ長いコンテキストを何度も送るエージェント処理では、共通部分をキャッシュに残せるぶん入力トークンの再送が減り、費用と待ち時間を抑えられます。ultraモードのように同じ前提を複数エージェントで共有する処理と組み合わせると、この効果が大きくなります。

## GPT-5.6の性能とGPT-5.5との違い｜ベンチマーク比較

性能を語るときは、体感ではなく公開ベンチマークで見ます。GPT-5.6が前世代からどこを伸ばしたのかを、数値と用途で確認します。

### Terminal-Bench・GeneBench等のベンチマークで示された性能

公開されたベンチマークでは、領域ごとに具体的な数値が示されています。要点は次の3つです。

- Terminal-Bench 2.1（コマンドラインのワークフロー評価）で、Sol Ultraが91.9%を記録
- GeneBench v1（生物学領域）で、GPT-5.5より強い結果を、より少ないトークンで達成
- ExploitBench（脆弱性領域）で、競合モデル級の性能を約3分の1の出力トークンで達成

数値の伸びだけでなく、同じ結果を少ないトークンで出している点が実務では効きます。出力トークンが減ればAPI料金と応答時間の両方が下がるためです。コーディング、生物学、サイバーセキュリティといったエージェント寄りの領域で改善が目立ちます。

### GPT-5.5からの進化点と前版からの移行を判断するための基準

前版のGPT-5.5との違いは、3モデルへの分割と推論制御の追加に集約されます。GPT-5.5が単一系列だったのに対し、GPT-5.6はSol・Terra・Lunaで性能帯を分け、Solにmax推論エフォート、シリーズ全体にultraモードを載せました。TerraはGPT-5.5級の性能をおおよそ半額で提供するため、コスト面だけでも移行の動機になります。前版の性能や料金の内訳と突き合わせて判断したい場合は、[GPT-5.5とGPT-5.4の違い・ベンチマーク・API料金の解説](https://www.issoh.co.jp/tech/details/11902/)と並べて比較すると、どの処理を新モデルへ移すかの線引きがつけやすくなります。

## GPT-5.6のAPI料金の仕組みと用途別モデル選定の判断基準

料金はモデル選定の中心になります。3モデルの単価を並べたうえで、どの処理をどのモデルに割り当てるかの基準を示します。

### Sol・Terra・LunaのAPI料金の比較（1Mトークン単価）

API料金は1Mトークンあたりで設定され、入力と出力で単価が分かれます。2026年7月の公開時点の発表値は次のとおりです。

| モデル   | 入力（1Mトークン） | 出力（1Mトークン） |
| ----- | ---------- | ---------- |
| Sol   | 5ドル        | 30ドル       |
| Terra | 2.5ドル      | 15ドル       |
| Luna  | 1ドル        | 6ドル        |

SolとLunaでは出力単価が5倍開きます。出力トークンは入力より高いため、長文を大量に生成する用途ほどモデル選定がコストに直結します。料金は改定されうるので、実装前に公式の最新価格を確認してください。

### 用途別のモデル選定｜精度優先とコスト優先の使い分けの判断基準

選定の原則はシンプルです。まずTerraを既定に置きます。GPT-5.5級の性能を半額帯で使えるため、社内文書の要約や問い合わせ対応など大半の業務はTerraで足りるからです。そこで精度が届かない処理、たとえば難度の高いコード生成や多段の推論だけをSolへ上げ、必要ならmax推論エフォートを併用します。逆に、分類やタグ付けのような軽く大量の処理はLunaへ落とし、単価を下げます。1つのモデルに寄せず、処理ごとに割り当てを変えるのが費用対効果の高い構成です。

## GPT-5.6の使い方｜ChatGPT・APIからの利用と実装への組み込み

使い方は、対話で使うか、システムに組み込むかで分かれます。実装に落とすときの入り口と勘所を整理します。

### ChatGPTとAPIからの利用と一般提供までの切り替えの考え方

個人が試すならChatGPTのモデル選択から、システムに組み込むならAPIから利用します。一般提供が始まる日本時間2026年7月10日以降は、既存のOpenAI API経由でモデル名を指定して呼び出す流れになる見込みです。APIの料金体系や呼び出しの基本は前世代から大きく変わらないため、GPT-5.5などを既にAPIで使っているなら、モデル指定を差し替える形で移行を試せます。API利用の全体像を先に押さえたい場合は、[ChatGPT APIの料金の仕組みと使い方](https://www.issoh.co.jp/column/details/13309/)が入口になります。

### 既存のLLM・エージェント基盤へGPT-5.6を組み込む際の勘所

既存システムへ載せ替える際は、3点を先に決めます。1つ目は処理ごとのモデル割り当てで、Terraを既定にSol・Lunaへ振り分ける設計です。2つ目はプロンプトキャッシュの設計で、共通の前提文にブレイクポイントを置いて再送コストを削ります。3つ目はultraモードを使う処理の切り分けで、並行処理が効く重いタスクへの限定です。既存のRAGやエージェントのパイプラインがあるなら、モデル呼び出し層を差し替えるだけで移行できる構成にしておくと、次の版が出たときも入れ替えが軽くなります。また、GPT-5.6が注入攻撃への耐性をどう獲得したかは、[自動レッドチーミングAI「GPT-Red」の仕組みと実測数値の解説](https://www.issoh.co.jp/tech/details/15307/)で確認できます。

## GPT-5.6を実務で採用すべき条件と見送るべき場面の判断基準

ここは言い切ります。GPT-5.6は全ての現場で今すぐ入れるべきものではありません。向く条件と、あえて見送る場面を分けて示します。

### 採用が向く条件｜高難度タスクとコスト効率を同時に両立させたいとき

採用が効くのは、次の状況がそろう場合です。すでにLLMをAPIで業務に組み込んでおり、処理ごとに精度とコストのバランスを取りたい。難度の高いコード生成やエージェント処理があり、max推論エフォートやultraモードで精度を底上げしたい。あるいは、現在GPT-5.5で回している処理のコストを、同等性能のTerraへ移して下げたい。こうした場合は、モデル呼び出し層を差し替えるだけで精度か費用のどちらかを改善できます。大量処理をLunaへ逃がせば、全体の単価も下がります。

### 見送るべき場面｜現行モデルで足りる/社内の統制が未整備のとき

逆に見送ったほうがよい場面もあります。現在の処理が単純な要約や定型応答で、既存モデルで精度もコストも足りているなら、新版へ移す実利は小さく、検証の手間だけが増えます。もう1つは、社内で生成AIの利用ルールや情報統制が整っていないケースです。サイバーセキュリティや生物学で能力が上がったモデルほど、入力してよい情報の範囲やログ管理を先に決めておくべきです。導入前に整えるべき社内ルールやリスク対策は、[生成AIのリスクとガバナンス対策・社内ルールの整え方](https://www.issoh.co.jp/tech/details/12777/)にまとめています。モデル選定から既存システムへの組み込み、統制設計までをまとめて外部に相談したい場合は、[生成AI・LLMを組み込むAIエンジン開発](https://www.issoh.co.jp/service/ai/recommend/)で受託の相談を受け付けています。

## よくある質問

GPT-5.6のモデルの違いや料金など、導入前に迷いやすい点をまとめます。なお後継として2026年9月にGPT-6 Astraが公開され、推論エフォートのnoneが使えなくなるなど移行時の変更点が出ています。提供経路ごとの料金差とあわせて[GPT-6 Astraの提供3経路と料金・データ境界の判断](https://www.issoh.co.jp/tech/details/17702/)で整理しました。

### GPT-5.6のSol・Terra・Lunaはどう違いますか？

性能とコストの帯が違います。Solは最高性能で高難度の推論やコーディング向け、Terraは前世代GPT-5.5級の性能を半額帯で使えるバランス型、Lunaは速度と低価格を優先した軽量モデルです。処理ごとに使い分ける前提で設計されています。

### GPT-5.6はいつから使えますか？

限定プレビューは2026年6月26日に米国政府との調整のもとで始まりました。一般提供は日本時間の2026年7月10日が予定されています。プレビュー段階は一部のパートナーに限られるため、広く使えるのは一般提供以降です。

### GPT-5.6のAPI料金はいくらですか？

公開時点の発表では、1MトークンあたりでSolが入力5ドル・出力30ドル、Terraが2.5ドル・15ドル、Lunaが1ドル・6ドルです。出力単価が高いため、長文を大量に生成する用途ほどモデル選定がコストを左右します。料金は改定されうるので公式の最新値を確認してください。

### GPT-5.6とGPT-5.5はどちらを使うべきですか？

コスト重視ならGPT-5.6のTerraが有力です。GPT-5.5級の性能をおおよそ半額で使えるためです。精度を最優先する処理はSolへ、軽く大量の処理はLunaへ振り分けると、GPT-5.5の単一構成より費用対効果を細かく調整できます。

### max推論エフォートとultraモードは何が違いますか？

max推論エフォートは、Solに推論時間を最大限与えて1つの答えの精度を上げる設定です。ultraモードは、複数のサブエージェントで作業を分担・並行させて複雑なタスクを速く仕上げる仕組みです。前者は深さ、後者は分担と速さを狙う機能で、目的が異なります。

## 関連記事

- [GPT-Live-1とは｜OpenAIの音声モデル](https://www.issoh.co.jp/tech/details/13355/)：GPT-5.6と同時期に出たOpenAIの新モデルで、リアルタイム音声の実装判断を解説しています。
- [プロンプトとは｜指示文の書き方と設計](https://www.issoh.co.jp/column/details/12963/)：GPT-5.6の精度を引き出すプロンプト設計とキャッシュ設計の前提になります。
- [AIエージェントの作り方](https://www.issoh.co.jp/column/details/12918/)：ultraモードのサブエージェント構成を自前で組む際の設計手順を解説しています。
- [AI開発とは｜工程・費用相場](https://www.issoh.co.jp/column/details/13319/)：GPT-5.6を組み込む開発の工程や内製と受託の判断材料になります。

---

出典: [GPT-5.6とは｜Sol・Terra・Lunaの3モデルと新機能・料金を実装目線で解説](<https://www.issoh.co.jp/tech/details/13357/>)（株式会社一創）
