対象読者:Gemini 3.5 Pro リークに注目し、Fable 5GPT-5.6 の主スタック選定に迷う開発チーム向けです。結論:三ルート混合+M4 降格が最適解。構成:信頼度分級、三大課題、決定マトリクス、六段階 SOP、引用データ、購入導線。

リーク信頼度の分級

2026年7月、X と The Information が Gemini 3.5 Pro の内部スペックを同時流出。Google は TPU v6 で最終調整を終え、Cloud Next 前に Fable 5GPT-5.6 Terra へ正面挑戦します。A ランク(200万 Token、Computer Use 2.0、信頼度約85%)のみ調達計画に先行反映し、B ランク(MMLU 89%超、SWE-bench 52%超)は GA 公式カードまで保留をお勧めします。C ランクの「全面超越」見出しは、コーディング遅延で Terra に劣るリークがあり、万能王者は存在しません。


三大選定課題

  1. リーク≠接続可能:プレビュー許可リスト・IAM 未整備で Agent が途中停止します。
  2. 三モデル課金累積:4人チームで月 ¥20万超も。統一ゲートウェイ必須です。
  3. ベンダーロック:単一依存は凍結時に CI 全体を止めます。

三強決定マトリクス

Gemini 3.5 ProFable 5GPT-5.6 Terra
コンテキスト200万 Token100万150万
Agent 強みComputer Use長程推論低遅延コーディング
初 Token P50約1.2秒約1.4秒約0.9秒
最適シーンGCP・超長文書Cursor 設計対話型開発

Google スタックは Gemini、IDE 重度は Fable 5 副ルート、高速コーディングは GPT-5.6 — 三混合+M4 降格が安定構成です。


六段階検証 SOP

  1. M4 に LiteLLM 三ルート(Gemini / Anthropic / OpenAI)を構築
  2. SWE-bench 30件+Agent 10件の評価セットを凍結
  3. Gemini プレビュー許可リストを申請
  4. Cursor を M4 ゲートウェイへ向け Fable 5 回帰
  5. 日次 Token 80%超で MLX 14B へ自動降格
  6. 14日カナリア後に主スタック重みを決定
戦略月コスト断服リスク
純 Gemini¥8.4万〜21万
三ルート+M4¥4.2万〜9.8万

引用データ(2026-07-08)

  • GA ウィンドウ:7月15〜18日 Cloud Next、API 名 gemini-3.5-pro-preview 予想
  • 算力:TPU v6 効率 v5 比約2.1倍、長文プレビュー課金約1.5倍
  • エコ連携:iOS 27 Siri は Gemini 2.5 採用済み、3.5 GA 後 Q3 OTA でアップグレード見込み
  • M4 降格:24GB で MLX 14B Q4 が 35〜45 Token/s、85% シーンをカバー

まとめ — データで主スタックを決める

Gemini 3.5 Pro リークは、200万 Token と Computer Use 2.0 で Google の本気を示します。GCP チームは主スタック再評価の好機です。一方、Fable 5 の長程ナラティブ Agent と GPT-5.6 の低遅延コーディング優位は一夜では消えません。

合理的な姿勢は、M4 専用ノードで三ルート対照実験を構築し、同一評価セットで14日間カナリアを走らせることです。クラウドでリークを追い、ローカルでパイプラインを守り、予算と安定性を両立できます。

関連:Gemini 7月公開解析 · Fable 5 比較

次の一手:LlmMac 購入ページで Mac mini M4 24GB をレンタルし、Gemini / Fable 5 / GPT-5.6 三モデル対照環境を本日構築。SSH 数分、LiteLLM 三ルート付き — GA 前にデータで決断してください。