対象読者:Gemini 3.5 Pro リークに注目し、Fable 5 と GPT-5.6 の主スタック選定に迷う開発チーム向けです。結論:三ルート混合+M4 降格が最適解。構成:信頼度分級、三大課題、決定マトリクス、六段階 SOP、引用データ、購入導線。
リーク信頼度の分級
2026年7月、X と The Information が Gemini 3.5 Pro の内部スペックを同時流出。Google は TPU v6 で最終調整を終え、Cloud Next 前に Fable 5 と GPT-5.6 Terra へ正面挑戦します。A ランク(200万 Token、Computer Use 2.0、信頼度約85%)のみ調達計画に先行反映し、B ランク(MMLU 89%超、SWE-bench 52%超)は GA 公式カードまで保留をお勧めします。C ランクの「全面超越」見出しは、コーディング遅延で Terra に劣るリークがあり、万能王者は存在しません。
三大選定課題
- リーク≠接続可能:プレビュー許可リスト・IAM 未整備で Agent が途中停止します。
- 三モデル課金累積:4人チームで月 ¥20万超も。統一ゲートウェイ必須です。
- ベンダーロック:単一依存は凍結時に CI 全体を止めます。
三強決定マトリクス
| 軸 | Gemini 3.5 Pro | Fable 5 | GPT-5.6 Terra |
|---|---|---|---|
| コンテキスト | 200万 Token | 100万 | 150万 |
| Agent 強み | Computer Use | 長程推論 | 低遅延コーディング |
| 初 Token P50 | 約1.2秒 | 約1.4秒 | 約0.9秒 |
| 最適シーン | GCP・超長文書 | Cursor 設計 | 対話型開発 |
Google スタックは Gemini、IDE 重度は Fable 5 副ルート、高速コーディングは GPT-5.6 — 三混合+M4 降格が安定構成です。
六段階検証 SOP
- M4 に LiteLLM 三ルート(Gemini / Anthropic / OpenAI)を構築
- SWE-bench 30件+Agent 10件の評価セットを凍結
- Gemini プレビュー許可リストを申請
- Cursor を M4 ゲートウェイへ向け Fable 5 回帰
- 日次 Token 80%超で MLX 14B へ自動降格
- 14日カナリア後に主スタック重みを決定
| 戦略 | 月コスト | 断服リスク |
|---|---|---|
| 純 Gemini | ¥8.4万〜21万 | 高 |
| 三ルート+M4 | ¥4.2万〜9.8万 | 低 |
引用データ(2026-07-08)
- GA ウィンドウ:7月15〜18日 Cloud Next、API 名
gemini-3.5-pro-preview予想 - 算力:TPU v6 効率 v5 比約2.1倍、長文プレビュー課金約1.5倍
- エコ連携:iOS 27 Siri は Gemini 2.5 採用済み、3.5 GA 後 Q3 OTA でアップグレード見込み
- M4 降格:24GB で MLX 14B Q4 が 35〜45 Token/s、85% シーンをカバー
まとめ — データで主スタックを決める
Gemini 3.5 Pro リークは、200万 Token と Computer Use 2.0 で Google の本気を示します。GCP チームは主スタック再評価の好機です。一方、Fable 5 の長程ナラティブ Agent と GPT-5.6 の低遅延コーディング優位は一夜では消えません。
合理的な姿勢は、M4 専用ノードで三ルート対照実験を構築し、同一評価セットで14日間カナリアを走らせることです。クラウドでリークを追い、ローカルでパイプラインを守り、予算と安定性を両立できます。
関連:Gemini 7月公開解析 · Fable 5 比較
次の一手:LlmMac 購入ページで Mac mini M4 24GB をレンタルし、Gemini / Fable 5 / GPT-5.6 三モデル対照環境を本日構築。SSH 数分、LiteLLM 三ルート付き — GA 前にデータで決断してください。