ご対象:2026年7月に GPT-5.6Sol / Terra / Luna 三ティアで全面開放された後、どのモデルを主スタックにすべきか迷う開発チームの方へ。結論:用途別混合ルート+M4 ローカル降格が最も安定します。本記事の構成:三モデル概要、三大課題、性能比較表、六段階導入 SOP、引用データ、購入ガイドです。

三モデル概要と全面開放の意味

2026年7月9日時点で、OpenAI は GPT-5.6 を ChatGPT Plus/Team/Enterprise および API 全体へ正式放量しました。従来プレビュー限定だった三ティアが、一般開発者も即日利用可能です。

Sol(ソル)— 高速軽量ティア
初 Token レイテンシ最優先。チャット補完、分類、短い Agent ターン向け。128K コンテキスト、入力単価は Terra 比約40%低。
Terra(テラ)— 汎用中核ティア
コーディング・ツール呼び出し・Agent オーケストレーションの主力。SWE-bench 実務スコア 54%超、Alignment Fix 適用済み。512K 標準コンテキスト。
Luna(ルナ)— 超長文・RAG ティア
150万 Token 窓で社内 Wiki 全文投入が可能。長文要約・契約レビュー・大規模 RAG に最適。出力単価は最高だが、分割チャンクより総コスト低減例が多い。

全面開放により、gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna の model 文字列が ChatGPT と API で統一されました。プレビュー期の旧名は移行ウィンドウ内に置換することをお勧めします。


三大選定課題

  1. 「最強=Terra」固定の罠:全リクエストを Terra に流すと、短ターンでも高単価が累積し、月次請求が想定の1.8倍に膨らむ事例があります。
  2. Luna の過剰利用:150万 Token は強力ですが、8K 程度の短文 QA でも Luna を選ぶと、レイテンシとコスト双方で非効率です。
  3. 単一ベンダー依存:OpenAI 側レート制限やメンテナンス時に CI/CD 全体が停止。ローカル MLX 降格ルートが未整備だと復旧に数時間かかります。

性能・コスト比較表(2026-07-09 GA)

項目SolTerraLuna
コンテキスト128K512K150万 Token
初 Token P50約0.45秒約0.85秒約1.6秒
SWE-bench41%54%49%(長文特化)
入力単価目安$0.80 / 1M$2.40 / 1M$4.20 / 1M
最適シーン分類・補完IDE・AgentRAG・契約書

用途別選定マトリクス

ワークロード推奨ティア理由
Cursor 対話コーディングTerra 主 / Sol 副精度と速度のバランス
社内規程 500ページ QALuna分割不要で幻覚率低減
ログ分類バッチSol低単価・高スループット
夜間 Agent 長時間ジョブTerra + M4 降格予算熔断で安定

Sol で入口を絞り、Terra で実装し、Luna で長文を処理する — この三層が GPT-5.6 全面開放後の実務標準構成です。


六段階導入 SOP

以下の手順は、Mac mini M4 リモートノード上で再現可能な標準フローです。敬体で順を追って実施してください。

  1. Step 1:LlmMac の M4 24GB ノードをレンタルし、SSH で接続します。
  2. Step 2:LiteLLM ゲートウェイに Sol / Terra / Luna 三ルートを登録します。
  3. Step 3:SWE-bench 30件+社内 Agent 10件の評価セットを凍結します。
  4. Step 4:入力トークン長・タスク種別に応じた自動ルーティングルールを設定します。
  5. Step 5:日次 Token 予算 80% 超過時に MLX 14B Q4 へ自動降格します。
  6. Step 6:14日間カナリア後、主スタック重み(Sol:Terra:Luna 比率)を確定します。

引用データ(2026-07-09)

  • API 名:gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna(ChatGPT 同期)
  • Agent 機能:Terra はネイティブ Tool Orchestration v2、Luna は Document Map-Reduce 内蔵
  • 四人体制月コスト:単一 Terra 固定で ¥18万〜、三混合+M4 降格で ¥6.8万〜9.2万
  • M4 降格性能:24GB で MLX 14B が 38〜48 Token/s、Sol 相当の短ターン 90% をカバー

まとめ — 全面開放後は「混合+検証」が正解

GPT-5.6 の全面開放は、Sol・Terra・Luna という明確な役割分担を一般開発者に届けた転換点です。Terra だけ、あるいは Luna だけに依存する選び方は、コストと安定性の両面でリスクが高くなります。

合理的な進め方は、専用 M4 ノードで三ルート混合環境を構築し、同一評価セットで14日間カナリアを走らせることです。クラウド API で最新性能を享受しつつ、ローカル MLX で予算と可用性を守れます。

関連:7月 Sol/Terra/Luna 比較 · OpenAI 7月動向 · Agent ワークフロー準備

次の一手:LlmMac 購入ページで Mac mini M4 24GB をレンタルし、GPT-5.6 三モデル混合検証環境を本日構築してください。LiteLLM 三ルートプリセット付き、SSH 接続数分 — 全面開放の恩恵をデータで確実に取り込みましょう。