本文の要点
- 公式確認済み:2026年5月19日 I/O で Gemini 3.5 ファミリーを発表;Gemini 3.5 Flash は当日 GA;Pro は社内利用中で「来月」公開予定——このスケジュールは延期済み。
- 7月13日時点:Pro は Vertex AI エンタープライズプレビュー;公開 API に
gemini-3.5-proの GA エントリなし;複数メディアが 7月17日 を目標日と報道するが、Google は未公表。 - 未公式確認・広く報道:2M token コンテキスト、Deep Think 推論レイヤー、API 約 $15/$60 /百万 token、Ultra $250/月 サブスクのハードル。
- 今すぐ使える:Gemini 3.5 Flash(1M コンテキスト、$1.50/$9 /百万 token)は多くの Agent・コーディングシナリオをカバー。
- 選定の分岐点は「どれが賢いか」ではなくコンテキスト長 × 推論コスト × 実行環境——長時間 Agent は クラウド Mac で 7×24 ツールチェーン実行が現実的。
先行結論:Flash は今日から使える、Pro は待つ価値はあるが本番には賭けない
Google が正式な model card を公開するまで、Pro に関する数字はすべて賭けであり、契約条項ではない。
三つだけ覚えてください:① Gemini 3.5 Flash は 2026 年 Google 開発者向けのデフォルト主力;② Gemini 3.5 Pro はファミリーの「重砲」だが 7月中旬時点で未 GA;③ 今「7月17日リリース」と噂の日付に本番を縛るのは、得より損が大きい。
Google の 公式ブログ は控えめだ:3.5 ファミリーは「frontier intelligence with action」——Agent とコーディング向け;Flash は当日フル公開;Pro は「社内利用中、来月公開を期待」。Sundar Pichai も I/O で同じ口径。公式本文に 2M コンテキスト、Deep Think、API 単価の記載はない——これらは後続メディア報道とエンタープライズプレビュー流出。信頼度は層別に見る必要がある。
エンジニアに現実的なやり方:Flash で Antigravity / Gemini API / Vertex の Agent パイプラインを通す、「倉庫全体を 2M token 一括投入」や「多段ハード推論」が必要なタスクは backlog に記録し、Gemini API changelog に GA エントリが出てからデフォルトモデルを切り替える。これは GPT-5.6 と Gemini 選定ガイド と同じ結論:モデル発表はますます密集するが、先に固定すべきはワークフロー入口と実行ノード。
1. なぜ Gemini 3.5 Pro は Flash より「難産」か?
Flash が I/O 当日に GA できたのは偶然ではない。Google は 3.5 Flash を高スループット・Agent 優先のデフォルトモデルに位置づけた:1M コンテキスト、動的 thinking デフォルト ON、Terminal-Bench 2.1 76.2% などのベンチマークは I/O 発表一覧 で公開済み。「Flash でもフラッグシップ級」——検索、Gemini App、Antigravity のデフォルト体験にとって重要だ。
Pro の役割は異なる。Business Insider、Geeky Gadgets など複数のテックメディアが報じると、Google はエンタープライズプレビューで長時間 Agent タスクの token 効率と品質が社内基準に届かず、アーキテクチャ級の再構築を実施。GA は 6 月から 7 月へスライド、報道の目標日は 7月17日。Google 広報は具体日にコメント拒否——「7月17日」は業界コンセンサス級の目標ウィンドウであり、SLA に書ける約束ではない。
旧計画の失敗点? I/O 直後に多くのチームがロードマップを「6月 Pro 全面切替」にした:
- 予算を「噂の $15/$60」で固定し、6月は Flash のみ課金可能で財務モデルが歪んだ。
- Vertex プレビューで作った prompt とツールチェーンをモデル ID 抽象化せず、GA 切替で手戻り。
- 「2M で倉庫丸ごと一括読み」を前提にし、Flash 1M + 検索/チャンクで 80% 達成できる点を無視。
- ノート PC で長時間 Agent を走らせ、蓋を閉じると切断——「Pro 待ち」と無関係なのにモデル未リリースのせいにされる。
Pro 延期の教訓:Google は基準未達の「Ultra 後継」でブランドを傷つけるより、1ヶ月遅らせる。利用者にとっては逆にシグナル——Flash はすでに十分強く、Pro は明確に上を行かないと独立価格帯に値しない。
2. Gemini 3.5 Pro とは?Flash との棲み分け
2.1 ファミリー定位(公式口径)
Google 公式によると、Gemini 3.5 は 2026 年次世代モデルファミリー。キーワードは Agent、コーディング、長時間タスク。Flash は「デフォルト・高速・広カバー」;Pro は「最難推論・最長コンテキスト・最高品質」——過去の Gemini Ultra / 3.1 Pro 帯の物語を引き継ぐが、I/O 原稿に「Ultra 改称」の文言はない。「3.5 Pro」のみ。
2.2 Gemini 3.5 Flash(GA 済み・対照群)
Pro を書くには Flash 対照が必須。さもないと「待つべきか」判断できない:
- API ID:
gemini-3.5-flash(GA、preview サフィックスなし) - コンテキスト:1,048,576 入力 token / 65,536 出力 token(公式ドキュメント)
- 価格:$1.50 / $9.00 /百万 input/output token;キャッシュ入力 $0.15
- 配信:Gemini App、Search AI Mode、Gemini API、AI Studio、Android Studio、Google Antigravity、Vertex AI、Gemini Enterprise
- 能力:マルチモーダル入力、関数呼び出し、コード実行、検索ツール、動的 thinking
2.3 Gemini 3.5 Pro(プレビュー / GA 待ち)
2026-07-13 時点で公開チャネルで確認できる状態:
- Google は Pro の存在と社内利用を認め、公開 rollout は「来月(6月)」から延期。
- Vertex AI エンタープライズ顧客は限定プレビューで試用可能(全開発者が自助開通できるわけではない)。
- 公開 Gemini API モデル一覧は
gemini-3.5-flashとgemini-3.1-pro-previewなどが中心、Pro GA の model card なし。
メディア報道の Pro 差別化能力(GA で検証待ち):
- 2M token コンテキスト——Flash の約2倍。倉庫コード全体、長文コンプライアンス文書、長 Agent 軌跡向け。
- Deep Think 推論レイヤー——多段論理、複雑数学、計画;サブスク帯と紐づくと報道(価格節参照)。
- 強化マルチモーダルと UI 生成——Gemini 3 系の対話型 Web UI を継承、hardest reasoning 向け。
- 低遅延は売りではない——Pro は品質優先、Flash と補完関係で代替ではない。
3. リリースタイムライン:I/O から 7月中旬まで
| 時期 | イベント | 信頼度 |
|---|---|---|
| 2026-05-19 | Google I/O:Gemini 3.5 発表;Flash GA;Pro 社内利用、来月公開予定 | 公式 |
| 2026-05 ~ 06 | Flash が Gemini App / Search AI Mode デフォルトに;Antigravity、Enterprise 同期 | 公式 |
| 2026-06 下旬 | メディア:Pro GA が 6 月から 7 月へ;Vertex プレビュー継続;API changelog に Pro GA なし | メディア報道 + API 現状 |
| 2026-07-08 ~ 17 | 複数 outlet:Google の目標 7月17日 GA;アーキ再構築とプレビュー feedback と関連と報道 | メディア報道(未公表) |
| 2026-07-13(執筆日) | Pro 未公開 GA;開発者は Flash で本番、changelog を監視 | 事実状態 |
公式発表をどう追う? 二つのソースを推奨:Google DeepMind / Gemini モデルブログ と Gemini API Changelog。GA 当日は通常同時に:model card、価格ページ更新、AI Studio デフォルトオプション。見出しだけでこの三つがなければ、まだプレビュー扱い。
4. 機能一覧:公式確認済み vs 未発表
| 能力 | Flash(GA) | Pro(予想 / 報道) | 状態 |
|---|---|---|---|
| Agent 長時間タスク | 公式主推 | より強い推論と計画 | Flash 確認済み;Pro は GA 後評価 |
| コンテキストウィンドウ | 1M tokens | 2M tokens(報道) | Flash 公式;Pro 未公表 |
| Deep Think / 深度推論 | 動的 thinking デフォルト ON | 独立 Deep Think 層(報道) | Pro 未公表 |
| コーディング / Terminal-Bench | 76.2%(I/O 発表) | Flash 超えを期待 | Flash に数値;Pro は未発表 |
| マルチモーダル | 画像・音声・動画入力 | より強い対話 UI(報道) | Flash 確認済み |
| Antigravity / Vertex | 接続済み | プレビュー中 | Flash GA;Pro エンタープライズプレビュー |
開発者にとって機能の「価値」はタスク形態次第:
- 単発 800K token 以内のコードレビュー + パッチ生成:Flash で通常十分、コストも管理しやすい。
- リポジトリ依存グラフ全体 + クロスサービス追跡 + 一括出力:2M に理論上の優位、ただし Pro の実測 latency と hallucination 率を待つ。
- 多段数学証明、複雑コンプライアンス推論:Deep Think が独立帯なら、OpenAI
reasoning.effort=maxや Claude extended thinking に近い位置づけの可能性。
5. Gemini 3.5 Pro 価格:公式空白と妥当な見積もり
Google は Pro の正式 API 価格を未発表。 以下は層別説明。噂を請求書にしないこと。
5.1 確認済み参考価格:Gemini 3.5 Flash
| 項目 | 価格(USD) |
|---|---|
| 入力 token | $1.50 / 百万(非グローバルリージョン約 $1.65) |
| 出力 token | $9.00 / 百万(非グローバルリージョン約 $9.90) |
| キャッシュ入力 | $0.15 / 百万 |
5.2 メディア報道の Pro 価格帯(未確認)
複数メディアの同オーダー推測。予算サンドボックス用のみ:
- API:約 $15 / 百万入力、$60 / 百万出力——Flash の約 10 倍オーダー。
- コンシューマーサブスク:Deep Think またはフル Pro 能力は Gemini Advanced / Ultra 帯(約 $250/月) が必要かも(報道口径、Google 価格ページではない)。
- 別 outlet は穏やかな API 推測($1.25 / $10)も——10 倍仮説と矛盾。GA 当日の model card が正。
5.3 競合との粗算(意思決定補助、リアルタイム見積もりではない)
Pro 噂価格と Flash、GPT-5.6 / Codex クォータ論理 を同じ枠で:
- 高頻度 Agent、日次百万 token 級:Flash または GPT-5.6 Luna/Terra が現実的。
- 低頻度・超長コンテキスト・一発勝負:Pro 2M は TCO 優位の可能性(少回数呼び出しで品質)、公式単価検証待ち。
- ターミナルコーディング Agent 7×24:モデル料金以外に実行環境(クラウド Mac 常時起動)が請求に効くことが多い。
6. 五軸比較:Pro(予想)vs Flash vs GPT-5.6 vs Claude
| 軸 | Gemini 3.5 Flash | Gemini 3.5 Pro(予想) | GPT-5.6 Sol | Claude Mythos 5 |
|---|---|---|---|---|
| 利用可能性 | GA、全チャネル | プレビュー / GA 待ち | GA(2026-07) | GA |
| コンテキスト | 1M(公式) | 2M(報道) | プラン / API 次第 | 約 200K+ |
| コーディング Agent | Terminal-Bench 76.2% | 未発表 | Terminal-Bench 88.8% | SWE-bench Pro 先行 |
| API 価格(オーダー) | $1.5 / $9 | 噂 ~$15 / $60 | Sol/Terra/Luna 分離 | 中〜高価格帯 |
| 最適入口 | Antigravity / Gemini API | Vertex + AI Studio(待ち) | Codex / Cursor | Claude Code CLI |
この表の意図は「誰が勝つ」ではなく単一デフォルト勝者はいないこと。Flash は Google エコシステム内で「十分速く十分安い」Agent 基盤;Pro が 2M + Deep Think を実現すれば超長文書とハード推論を補完;OpenAI と Anthropic はターミナルコーディングと IDE 入口で依然成熟。詳細は GPT-5.6 コーディング選定ガイド。
7. シナリオ選定マトリクス
| シナリオ | 今の推奨 | Pro GA 後に再評価 | 非推奨 |
|---|---|---|---|
| Antigravity デフォルト Agent | 3.5 Flash | タスク別 Pro 切替 | Pro 待ちで停止 |
| 単発 <1M token コードレビュー | 3.5 Flash | — | Pro プレビューに無理やり |
| monorepo 倉庫一括分析 | Flash + チャンク / 検索 | 3.5 Pro 2M | ノート PC ローカル硬走 |
| 複雑な財務 / コンプライアンス多段推論 | Flash + 人手レビュー | Deep Think(公表後) | 無料枠で長 Agent |
| iOS / Xcode CI Agent | Flash API + クラウド Mac | Pro 長コンテキスト | Web UI のみでツールチェーンなし |
| 本番 SLA システム | Flash GA + バージョン固定 | Pro GA + カナリア | 噂のリリース日に縛る |
8. 推奨スタック
【Stack A — 個人開発者 / 試験】
モデル:Gemini 3.5 Flash(AI Studio または API)
入口:Antigravity または自前スクリプト + function calling
実行:ローカル短タスク;長タスクはクラウド Mac へ
予算:Flash $1.5/$9 で token 見積;Pro 10× で予約しない
【Stack B — エンタープライズ Vertex】
モデル:Flash 本番 + Pro プレビューは別 project
ガバナンス:プレビューと本番で service account 分離;モデル ID は環境変数化
監視:changelog RSS + 費用アラート(BigQuery billing エクスポート)
切替:Pro GA 後 10% カナリア → ベンチマーク回帰 → 全量
【Stack C — マルチモデルコーディングチーム】
検索 / 大規模倉庫スキャン:Gemini 3.5 Flash
ハード推論 / アーキレビュー:Pro 待ちまたは Claude extended thinking
ターミナル改修:Claude Code または Codex on クラウド Mac worktree
IDE 日常:Cursor + GPT-5.6 Terra
原則:同一タスクに「主モデル」は一つ、二重 token を避ける
9. よくある誤解
- 誤解 1:メディア報道を model card とみなす。2M、Deep Think、$15/$60 は Google 公式 I/O 文に未記載;アーキ文書に書く前に「未確認」と明記。
- 誤解 2:Flash は過渡品。I/O データは Flash が複数 Agent ベンチで前世代 3.1 Pro を上回る;主力であり「lite」ではない。
- 誤解 3:Pro 登場で全員切替。長いコンテキスト ≠ 低総コスト;2M 単発呼び出しの失敗リトライはより高くつく可能性。
- 誤解 4:Antigravity と API の差を無視。同一モデルでも harness ごとにツール一覧、権限、遅延が異なる——実入口で計測。
- 誤解 5:Pro 待ちの間何もデプロイしない。競合は待たない;Flash で Agent パイプラインを先に通す方が二週間空待ちより価値がある。
10. 導入ステップ(7つ)
- タスク棚卸し:>1M コンテキストまたはハード推論が必要なタスク比率;<20% なら Flash を主モデルに。
- Flash 本番経路開通:AI Studio または Vertex でプロジェクト作成、API key / workload identity は環境分離。
- モデル ID 抽象化:コードに
GEMINI_MODEL=gemini-3.5-flash、散在ハードコード禁止、Pro GA 切替を容易に。 - 長 Agent を実行ノードへ:数時間ツールチェーンは クラウド Mac、ローカルスリープ切断を避ける(Flash/Pro 選定と直交だが重要)。
- changelog 購読:Gemini API + Google AI ブログ;7月中下旬の GA 確認をカレンダーに。
- Pro GA 当日フロー:model card 読む → 内部 golden set → Flash とコスト・品質比較 → 10% カナリア。
- 二週間振り返り:token 量、タスク成功率、人手介入回数を記録——データで Pro の 10× 単価が値するか判断。
11. FAQ
Gemini 3.5 Pro はリリースされた?
2026年7月13日時点で未公開 GA。Google は 5月19日 I/O で Pro 社内利用と翌月公開を発表;現在延期段階。エンタープライズ顧客は Vertex AI プレビューで限定試用可能。複数メディアが目標日 7月17日と報道するが、Google は未確認。
Gemini 3.5 Pro と Flash の違いは?
Flash は全面利用可能、高速 Agent とコーディング、1M コンテキスト、$1.50/$9 /百万 token。Pro はファミリーフラッグシップ想定:報道では 2M コンテキスト、Deep Think 深度推論、より高い API 単価と多段タスク能力;具体仕様は GA model card 準拠。
Gemini 3.5 Pro の価格は?
Google は Pro 正式価格を未発表。 メディアの一般的推測は API 約 $15/$60 /百万 input/output token、Flash の約 10 倍;Deep Think は約 $250/月 Ultra 帯と紐づく可能性(報道)。公式価格ページ更新までは Flash 価格のみ契約・予算に記載。
今どの Gemini モデルを使うべき?
本番は Gemini 3.5 Flash(gemini-3.5-flash)優先。Google エコシステム内 Agent、Antigravity、Enterprise オーケストレーションでは Flash が 2026 年デフォルト。Pro はプレビュー資格内でのみ評価し、本番トラフィックと分離。
2M コンテキストのために Pro を待つ価値は?
タスク次第:1M + RAG/チャンクで 80% 満たせるなら待つ必要なし。単発で倉庫全体投入がルーティンでリトライコストが極大なら、Pro GA 後に A/B。GA 前に噂の 2M にアーキを賭けない。
12. まとめ
Gemini 3.5 Pro とは?——2026 年 I/O で発表された 3.5 ファミリーフラッグシップ、最難推論と最長コンテキスト向けだが 7月中旬時点で未 GA。機能と価格では Flash に完全な model card あり;Pro の 2M、Deep Think、$15/$60 などの重要数字は「信頼できる報道・未公表」。リリース時期は「6月」から「7月中下旬」へスライド、API changelog を正とし、メディアのカウントダウンに依存しない。
現実的な道は一つ:今日 Flash で Agent を走らせ、明日 Pro で増分アップグレード。 モデル戦争は毎週ニュースがあるが、エンジニアリングチームが固定すべきは実行環境、モデル ID 抽象化、コストダッシュボード——あとは Sundar が次にブログで署名する日にデフォルト設定を変えればよい。
Pro を待つ間、Flash + クラウド Mac で Agent を安定稼働
Gemini 3.5 Flash で API コーディング Agent を組み、実行層はクラウド Mac mini M4——xcodebuild、Git worktree、SSH 長セッションが切れない。Pro GA 後は環境変数の model ID を変えるだけでパイプライン再構築不要;Apple Silicon ユニファイドメモリ は 1M 級長コンテキストに適し、macOS 分離 で Agent の誤操作リスクを下げる。
日額で Antigravity / Gemini API のスモークを通し、月額で常駐へ。 kvmboot クラウド Mac mini M4 は「Flash 今日、Pro 明日」の現実的な起点—— プランを見る 、GA 待ちの時間を届けられる Agent パイプラインに変える。