期間限定

Gemini 3.5 Pro とは?機能・料金・リリース時期を完全解説(2026)

AI エンジニアリングGemini 3.5 · モデル解説
2026-07-13約12分

Google公式と報道の切り分け:2Mコンテキスト、Deep Think、API料金、7月中旬GA予定。Flash・GPT-5.6との五軸比較と7ステップ導入。

2026年7月13日時点で、GoogleはI/OでGemini 3.5ファミリーを発表しFlashをGAしましたが、Gemini 3.5 Proはまだ公開GAではありません。本記事は「公式が言ったこと」と「報道で伝わっていること」を分け、今Flashで進めるべきかPro向けに予算を確保すべきかを整理します。

本文の要点

  1. 公式確認済み:2026年5月19日 I/O で Gemini 3.5 ファミリーを発表;Gemini 3.5 Flash は当日 GA;Pro は社内利用中で「来月」公開予定——このスケジュールは延期済み。
  2. 7月13日時点:Pro は Vertex AI エンタープライズプレビュー;公開 API に gemini-3.5-pro の GA エントリなし;複数メディアが 7月17日 を目標日と報道するが、Google は未公表。
  3. 未公式確認・広く報道:2M token コンテキスト、Deep Think 推論レイヤー、API 約 $15/$60 /百万 token、Ultra $250/月 サブスクのハードル。
  4. 今すぐ使えるGemini 3.5 Flash(1M コンテキスト、$1.50/$9 /百万 token)は多くの Agent・コーディングシナリオをカバー。
  5. 選定の分岐点は「どれが賢いか」ではなくコンテキスト長 × 推論コスト × 実行環境——長時間 Agent は クラウド Mac で 7×24 ツールチェーン実行が現実的。
ニューラルネットワークとデータフローの可視化。Gemini 3.5 Pro の長コンテキストと推論能力を象徴
Gemini 3.5 Pro の焦点は「あるかないか」ではなく、GA 当日の仕様がプレビューと一致するか。

先行結論:Flash は今日から使える、Pro は待つ価値はあるが本番には賭けない

Google が正式な model card を公開するまで、Pro に関する数字はすべて賭けであり、契約条項ではない。

三つだけ覚えてください:① Gemini 3.5 Flash は 2026 年 Google 開発者向けのデフォルト主力;② Gemini 3.5 Pro はファミリーの「重砲」だが 7月中旬時点で未 GA;③ 今「7月17日リリース」と噂の日付に本番を縛るのは、得より損が大きい。

Google の 公式ブログ は控えめだ:3.5 ファミリーは「frontier intelligence with action」——Agent とコーディング向け;Flash は当日フル公開;Pro は「社内利用中、来月公開を期待」。Sundar Pichai も I/O で同じ口径。公式本文に 2M コンテキスト、Deep Think、API 単価の記載はない——これらは後続メディア報道とエンタープライズプレビュー流出。信頼度は層別に見る必要がある。

エンジニアに現実的なやり方:Flash で Antigravity / Gemini API / Vertex の Agent パイプラインを通す、「倉庫全体を 2M token 一括投入」や「多段ハード推論」が必要なタスクは backlog に記録し、Gemini API changelog に GA エントリが出てからデフォルトモデルを切り替える。これは GPT-5.6 と Gemini 選定ガイド と同じ結論:モデル発表はますます密集するが、先に固定すべきはワークフロー入口と実行ノード。

1. なぜ Gemini 3.5 Pro は Flash より「難産」か?

Flash が I/O 当日に GA できたのは偶然ではない。Google は 3.5 Flash を高スループット・Agent 優先のデフォルトモデルに位置づけた:1M コンテキスト、動的 thinking デフォルト ON、Terminal-Bench 2.1 76.2% などのベンチマークは I/O 発表一覧 で公開済み。「Flash でもフラッグシップ級」——検索、Gemini App、Antigravity のデフォルト体験にとって重要だ。

Pro の役割は異なる。Business Insider、Geeky Gadgets など複数のテックメディアが報じると、Google はエンタープライズプレビューで長時間 Agent タスクの token 効率と品質が社内基準に届かず、アーキテクチャ級の再構築を実施。GA は 6 月から 7 月へスライド、報道の目標日は 7月17日。Google 広報は具体日にコメント拒否——「7月17日」は業界コンセンサス級の目標ウィンドウであり、SLA に書ける約束ではない。

旧計画の失敗点? I/O 直後に多くのチームがロードマップを「6月 Pro 全面切替」にした:

  • 予算を「噂の $15/$60」で固定し、6月は Flash のみ課金可能で財務モデルが歪んだ。
  • Vertex プレビューで作った prompt とツールチェーンをモデル ID 抽象化せず、GA 切替で手戻り。
  • 「2M で倉庫丸ごと一括読み」を前提にし、Flash 1M + 検索/チャンクで 80% 達成できる点を無視。
  • ノート PC で長時間 Agent を走らせ、蓋を閉じると切断——「Pro 待ち」と無関係なのにモデル未リリースのせいにされる。

Pro 延期の教訓:Google は基準未達の「Ultra 後継」でブランドを傷つけるより、1ヶ月遅らせる。利用者にとっては逆にシグナル——Flash はすでに十分強く、Pro は明確に上を行かないと独立価格帯に値しない。

2. Gemini 3.5 Pro とは?Flash との棲み分け

2.1 ファミリー定位(公式口径)

Google 公式によると、Gemini 3.5 は 2026 年次世代モデルファミリー。キーワードは Agent、コーディング、長時間タスク。Flash は「デフォルト・高速・広カバー」;Pro は「最難推論・最長コンテキスト・最高品質」——過去の Gemini Ultra / 3.1 Pro 帯の物語を引き継ぐが、I/O 原稿に「Ultra 改称」の文言はない。「3.5 Pro」のみ。

2.2 Gemini 3.5 Flash(GA 済み・対照群)

Pro を書くには Flash 対照が必須。さもないと「待つべきか」判断できない:

  • API IDgemini-3.5-flash(GA、preview サフィックスなし)
  • コンテキスト:1,048,576 入力 token / 65,536 出力 token(公式ドキュメント)
  • 価格:$1.50 / $9.00 /百万 input/output token;キャッシュ入力 $0.15
  • 配信:Gemini App、Search AI Mode、Gemini API、AI Studio、Android Studio、Google Antigravity、Vertex AI、Gemini Enterprise
  • 能力:マルチモーダル入力、関数呼び出し、コード実行、検索ツール、動的 thinking

2.3 Gemini 3.5 Pro(プレビュー / GA 待ち)

2026-07-13 時点で公開チャネルで確認できる状態:

  • Google は Pro の存在と社内利用を認め、公開 rollout は「来月(6月)」から延期。
  • Vertex AI エンタープライズ顧客は限定プレビューで試用可能(全開発者が自助開通できるわけではない)。
  • 公開 Gemini API モデル一覧は gemini-3.5-flashgemini-3.1-pro-preview などが中心、Pro GA の model card なし

メディア報道の Pro 差別化能力(GA で検証待ち):

  • 2M token コンテキスト——Flash の約2倍。倉庫コード全体、長文コンプライアンス文書、長 Agent 軌跡向け。
  • Deep Think 推論レイヤー——多段論理、複雑数学、計画;サブスク帯と紐づくと報道(価格節参照)。
  • 強化マルチモーダルと UI 生成——Gemini 3 系の対話型 Web UI を継承、hardest reasoning 向け。
  • 低遅延は売りではない——Pro は品質優先、Flash と補完関係で代替ではない。

3. リリースタイムライン:I/O から 7月中旬まで

時期 イベント 信頼度
2026-05-19 Google I/O:Gemini 3.5 発表;Flash GA;Pro 社内利用、来月公開予定 公式
2026-05 ~ 06 Flash が Gemini App / Search AI Mode デフォルトに;Antigravity、Enterprise 同期 公式
2026-06 下旬 メディア:Pro GA が 6 月から 7 月へ;Vertex プレビュー継続;API changelog に Pro GA なし メディア報道 + API 現状
2026-07-08 ~ 17 複数 outlet:Google の目標 7月17日 GA;アーキ再構築とプレビュー feedback と関連と報道 メディア報道(未公表)
2026-07-13(執筆日) Pro 未公開 GA;開発者は Flash で本番、changelog を監視 事実状態

公式発表をどう追う? 二つのソースを推奨:Google DeepMind / Gemini モデルブログGemini API Changelog。GA 当日は通常同時に:model card、価格ページ更新、AI Studio デフォルトオプション。見出しだけでこの三つがなければ、まだプレビュー扱い。

4. 機能一覧:公式確認済み vs 未発表

能力 Flash(GA) Pro(予想 / 報道) 状態
Agent 長時間タスク 公式主推 より強い推論と計画 Flash 確認済み;Pro は GA 後評価
コンテキストウィンドウ 1M tokens 2M tokens(報道) Flash 公式;Pro 未公表
Deep Think / 深度推論 動的 thinking デフォルト ON 独立 Deep Think 層(報道) Pro 未公表
コーディング / Terminal-Bench 76.2%(I/O 発表) Flash 超えを期待 Flash に数値;Pro は未発表
マルチモーダル 画像・音声・動画入力 より強い対話 UI(報道) Flash 確認済み
Antigravity / Vertex 接続済み プレビュー中 Flash GA;Pro エンタープライズプレビュー

開発者にとって機能の「価値」はタスク形態次第:

  • 単発 800K token 以内のコードレビュー + パッチ生成:Flash で通常十分、コストも管理しやすい。
  • リポジトリ依存グラフ全体 + クロスサービス追跡 + 一括出力:2M に理論上の優位、ただし Pro の実測 latency と hallucination 率を待つ。
  • 多段数学証明、複雑コンプライアンス推論:Deep Think が独立帯なら、OpenAI reasoning.effort=max や Claude extended thinking に近い位置づけの可能性。

5. Gemini 3.5 Pro 価格:公式空白と妥当な見積もり

Google は Pro の正式 API 価格を未発表。 以下は層別説明。噂を請求書にしないこと。

5.1 確認済み参考価格:Gemini 3.5 Flash

項目 価格(USD)
入力 token $1.50 / 百万(非グローバルリージョン約 $1.65)
出力 token $9.00 / 百万(非グローバルリージョン約 $9.90)
キャッシュ入力 $0.15 / 百万

5.2 メディア報道の Pro 価格帯(未確認)

複数メディアの同オーダー推測。予算サンドボックス用のみ:

  • API:約 $15 / 百万入力$60 / 百万出力——Flash の約 10 倍オーダー。
  • コンシューマーサブスク:Deep Think またはフル Pro 能力は Gemini Advanced / Ultra 帯(約 $250/月) が必要かも(報道口径、Google 価格ページではない)。
  • 別 outlet は穏やかな API 推測($1.25 / $10)も——10 倍仮説と矛盾。GA 当日の model card が正

5.3 競合との粗算(意思決定補助、リアルタイム見積もりではない)

Pro 噂価格と Flash、GPT-5.6 / Codex クォータ論理 を同じ枠で:

  • 高頻度 Agent、日次百万 token 級:Flash または GPT-5.6 Luna/Terra が現実的。
  • 低頻度・超長コンテキスト・一発勝負:Pro 2M は TCO 優位の可能性(少回数呼び出しで品質)、公式単価検証待ち。
  • ターミナルコーディング Agent 7×24:モデル料金以外に実行環境(クラウド Mac 常時起動)が請求に効くことが多い。

6. 五軸比較:Pro(予想)vs Flash vs GPT-5.6 vs Claude

Gemini 3.5 Flash Gemini 3.5 Pro(予想) GPT-5.6 Sol Claude Mythos 5
利用可能性 GA、全チャネル プレビュー / GA 待ち GA(2026-07) GA
コンテキスト 1M(公式) 2M(報道) プラン / API 次第 約 200K+
コーディング Agent Terminal-Bench 76.2% 未発表 Terminal-Bench 88.8% SWE-bench Pro 先行
API 価格(オーダー) $1.5 / $9 噂 ~$15 / $60 Sol/Terra/Luna 分離 中〜高価格帯
最適入口 Antigravity / Gemini API Vertex + AI Studio(待ち) Codex / Cursor Claude Code CLI

この表の意図は「誰が勝つ」ではなく単一デフォルト勝者はいないこと。Flash は Google エコシステム内で「十分速く十分安い」Agent 基盤;Pro が 2M + Deep Think を実現すれば超長文書とハード推論を補完;OpenAI と Anthropic はターミナルコーディングと IDE 入口で依然成熟。詳細は GPT-5.6 コーディング選定ガイド

7. シナリオ選定マトリクス

シナリオ 今の推奨 Pro GA 後に再評価 非推奨
Antigravity デフォルト Agent 3.5 Flash タスク別 Pro 切替 Pro 待ちで停止
単発 <1M token コードレビュー 3.5 Flash Pro プレビューに無理やり
monorepo 倉庫一括分析 Flash + チャンク / 検索 3.5 Pro 2M ノート PC ローカル硬走
複雑な財務 / コンプライアンス多段推論 Flash + 人手レビュー Deep Think(公表後) 無料枠で長 Agent
iOS / Xcode CI Agent Flash API + クラウド Mac Pro 長コンテキスト Web UI のみでツールチェーンなし
本番 SLA システム Flash GA + バージョン固定 Pro GA + カナリア 噂のリリース日に縛る

8. 推奨スタック

【Stack A — 個人開発者 / 試験】
モデル:Gemini 3.5 Flash(AI Studio または API)
入口:Antigravity または自前スクリプト + function calling
実行:ローカル短タスク;長タスクはクラウド Mac へ
予算:Flash $1.5/$9 で token 見積;Pro 10× で予約しない

【Stack B — エンタープライズ Vertex】
モデル:Flash 本番 + Pro プレビューは別 project
ガバナンス:プレビューと本番で service account 分離;モデル ID は環境変数化
監視:changelog RSS + 費用アラート(BigQuery billing エクスポート)
切替:Pro GA 後 10% カナリア → ベンチマーク回帰 → 全量

【Stack C — マルチモデルコーディングチーム】
検索 / 大規模倉庫スキャン:Gemini 3.5 Flash
ハード推論 / アーキレビュー:Pro 待ちまたは Claude extended thinking
ターミナル改修:Claude Code または Codex on クラウド Mac worktree
IDE 日常:Cursor + GPT-5.6 Terra
原則:同一タスクに「主モデル」は一つ、二重 token を避ける

9. よくある誤解

  • 誤解 1:メディア報道を model card とみなす。2M、Deep Think、$15/$60 は Google 公式 I/O 文に未記載;アーキ文書に書く前に「未確認」と明記。
  • 誤解 2:Flash は過渡品。I/O データは Flash が複数 Agent ベンチで前世代 3.1 Pro を上回る;主力であり「lite」ではない。
  • 誤解 3:Pro 登場で全員切替。長いコンテキスト ≠ 低総コスト;2M 単発呼び出しの失敗リトライはより高くつく可能性。
  • 誤解 4:Antigravity と API の差を無視。同一モデルでも harness ごとにツール一覧、権限、遅延が異なる——実入口で計測。
  • 誤解 5:Pro 待ちの間何もデプロイしない。競合は待たない;Flash で Agent パイプラインを先に通す方が二週間空待ちより価値がある。

10. 導入ステップ(7つ)

  1. タスク棚卸し:>1M コンテキストまたはハード推論が必要なタスク比率;<20% なら Flash を主モデルに。
  2. Flash 本番経路開通:AI Studio または Vertex でプロジェクト作成、API key / workload identity は環境分離。
  3. モデル ID 抽象化:コードに GEMINI_MODEL=gemini-3.5-flash、散在ハードコード禁止、Pro GA 切替を容易に。
  4. 長 Agent を実行ノードへ:数時間ツールチェーンは クラウド Mac、ローカルスリープ切断を避ける(Flash/Pro 選定と直交だが重要)。
  5. changelog 購読:Gemini API + Google AI ブログ;7月中下旬の GA 確認をカレンダーに。
  6. Pro GA 当日フロー:model card 読む → 内部 golden set → Flash とコスト・品質比較 → 10% カナリア。
  7. 二週間振り返り:token 量、タスク成功率、人手介入回数を記録——データで Pro の 10× 単価が値するか判断。

11. FAQ

Gemini 3.5 Pro はリリースされた?

2026年7月13日時点で未公開 GA。Google は 5月19日 I/O で Pro 社内利用と翌月公開を発表;現在延期段階。エンタープライズ顧客は Vertex AI プレビューで限定試用可能。複数メディアが目標日 7月17日と報道するが、Google は未確認。

Gemini 3.5 Pro と Flash の違いは?

Flash は全面利用可能、高速 Agent とコーディング、1M コンテキスト、$1.50/$9 /百万 token。Pro はファミリーフラッグシップ想定:報道では 2M コンテキスト、Deep Think 深度推論、より高い API 単価と多段タスク能力;具体仕様は GA model card 準拠。

Gemini 3.5 Pro の価格は?

Google は Pro 正式価格を未発表。 メディアの一般的推測は API 約 $15/$60 /百万 input/output token、Flash の約 10 倍;Deep Think は約 $250/月 Ultra 帯と紐づく可能性(報道)。公式価格ページ更新までは Flash 価格のみ契約・予算に記載。

今どの Gemini モデルを使うべき?

本番は Gemini 3.5 Flashgemini-3.5-flash)優先。Google エコシステム内 Agent、Antigravity、Enterprise オーケストレーションでは Flash が 2026 年デフォルト。Pro はプレビュー資格内でのみ評価し、本番トラフィックと分離。

2M コンテキストのために Pro を待つ価値は?

タスク次第:1M + RAG/チャンクで 80% 満たせるなら待つ必要なし。単発で倉庫全体投入がルーティンでリトライコストが極大なら、Pro GA 後に A/B。GA 前に噂の 2M にアーキを賭けない。

12. まとめ

Gemini 3.5 Pro とは?——2026 年 I/O で発表された 3.5 ファミリーフラッグシップ、最難推論と最長コンテキスト向けだが 7月中旬時点で未 GA。機能と価格では Flash に完全な model card あり;Pro の 2M、Deep Think、$15/$60 などの重要数字は「信頼できる報道・未公表」。リリース時期は「6月」から「7月中下旬」へスライド、API changelog を正とし、メディアのカウントダウンに依存しない。

現実的な道は一つ:今日 Flash で Agent を走らせ、明日 Pro で増分アップグレード。 モデル戦争は毎週ニュースがあるが、エンジニアリングチームが固定すべきは実行環境、モデル ID 抽象化、コストダッシュボード——あとは Sundar が次にブログで署名する日にデフォルト設定を変えればよい。

Pro を待つ間、Flash + クラウド Mac で Agent を安定稼働

Gemini 3.5 Flash で API コーディング Agent を組み、実行層はクラウド Mac mini M4——xcodebuild、Git worktree、SSH 長セッションが切れない。Pro GA 後は環境変数の model ID を変えるだけでパイプライン再構築不要;Apple Silicon ユニファイドメモリ は 1M 級長コンテキストに適し、macOS 分離 で Agent の誤操作リスクを下げる。

日額で Antigravity / Gemini API のスモークを通し、月額で常駐へ。 kvmboot クラウド Mac mini M4 は「Flash 今日、Pro 明日」の現実的な起点—— プランを見る 、GA 待ちの時間を届けられる Agent パイプラインに変える。