Спецпредложение

Что такое Gemini 3.5 Pro? Функции, цена и дата выхода (2026)

AI-разработкаGemini 3.5 · Обзор модели
2026-07-1312 минут чтения

Официально vs СМИ: контекст 2M, Deep Think, цены API, GA в середине июля; сравнение по пяти осям с Flash и GPT-5.6 и план из 7 шагов.

На 13 июля 2026 Google представил семейство Gemini 3.5 на I/O и выпустил Flash в GA, но Gemini 3.5 Pro всё ещё не в публичном GA. Это руководство разделяет официальные факты и сообщения прессы, чтобы решить — работать на Flash сейчас или закладывать бюджет на Pro.

Ключевые выводы

  1. Официально подтверждено: 19 мая 2026 на I/O представлено семейство Gemini 3.5; Gemini 3.5 Flash в GA в тот же день; Pro используется внутри компании, публичный rollout планировался «в следующем месяце» — срок сдвинут.
  2. На 13 июля: Pro всё ещё в корпоративном превью Vertex AI; в публичном API нет GA-записи gemini-3.5-pro; СМИ называют целью 17 июля — Google не подтвердил.
  3. Не подтверждено официально, но широко в прессе: контекст 2M токенов, слой Deep Think, API ~$15/$60 за миллион токенов, подписка Ultra ~$250/мес.
  4. Уже доступно: Gemini 3.5 Flash (1M контекста, $1,50/$9 за миллион) покрывает большинство сценариев агентов и кодинга.
  5. Критерий выбора — не «кто умнее», а длина контекста × стоимость рассуждений × среда выполнения — длинные агенты лучше крутить на облачном Mac 24/7.
Визуализация нейросетей и потоков данных — символ длинного контекста и рассуждений Gemini 3.5 Pro
Вопрос по Gemini 3.5 Pro не в «будет ли», а совпадут ли спецификации GA с превью.

Предварительный вывод: Flash работает сегодня, Pro стоит ждать — но не для продакшена

Пока Google не опубликовал официальную model card, все цифры по Pro — ставки, а не условия договора.

Три фразы на запоминание: ① Gemini 3.5 Flash — уже дефолт Google для разработчиков в 2026; ② Gemini 3.5 Pro — «тяжёлая артиллерия» семейства, но к середине июля всё ещё не в публичном GA; ③ привязывать прод к дате «вроде 17 июля» рискованнее, чем выгодно.

В официальном блоге Google сдержан: семейство 3.5 — «frontier intelligence with action», агенты и код; Flash сразу доступен; Pro «внутри компании, публичный запуск ожидается в следующем месяце». Sundar Pichai на сцене I/O — та же линия. В официальном тексте нет 2M контекста, Deep Think и цен API — это пресса и утечки из enterprise-превью, нужен уровень доверия.

Прагматично для инженеров: Flash для Antigravity / Gemini API / Vertex-агентов, задачи «2M токенов весь репозиторий» или «жёсткое многошаговое рассуждение» — в backlog, смена дефолтной модели — когда в changelog Gemini API появится GA. Как в нашем гайде по GPT-5.6 и Gemini: релизы моделей учащаются — сначала фиксируйте вход workflow и узел выполнения.

1. Почему Gemini 3.5 Pro «задерживается» сильнее Flash?

GA Flash в день I/O — не случайность. Google позиционирует 3.5 Flash как дефолт высокой пропускной способности, приоритет агентов: 1M контекста, динамический thinking по умолчанию, Terminal-Bench 2.1 76,2% в списке анонсов I/O. Цель — показать, что «Flash тянет flagship» — важно для поиска, Gemini App и дефолта Antigravity.

У Pro другая роль. Пресса (Business Insider, Geeky Gadgets и др.) пишет: в enterprise-превью эффективность токенов и качество на длинных агентских задачах не достигли внутренней планки — перестройка архитектуры, GA сдвинут с июня на июль, в статьях цель 17 июля. Google не комментирует даты — «17 июля» — окно отраслевого консенсуса, не обещание SLA.

Где провалился старый план? Многие после I/O записали «в июне полный переход на Pro»:

  • Бюджет зафиксирован под «слухи $15/$60», а в июне биллится только Flash — финмодель искажена.
  • Промпты и toolchains в Vertex-превью без абстракции model ID — переделка при GA.
  • «2M весь репозиторий за раз» как архитектурная предпосылка — Flash 1M + retrieval/чанки часто дают 80%.
  • Длинный агент на ноутбуке: крышка закрыта — связь оборвана; не вина Pro, но списывают на задержку релиза.

Урок: Google лучше подождёт месяц, чем выпустит «наследника Ultra» ниже планки и ударит по бренду. Сигнал: Flash уже силён — Pro должен быть заметно сильнее для своей ценовой ступени.

2. Что такое Gemini 3.5 Pro? Отличие от Flash

2.1 Позиционирование семейства (официально)

По Google, Gemini 3.5 — новое семейство 2026 с фокусом агенты, код, длинные задачи. Flash: «дефолт, скорость, широкое покрытие»; Pro: «самое сложное рассуждение, самый длинный контекст, максимальное качество» — наследник Gemini Ultra / 3.1 Pro, без формулировки «Ultra переименован» в тексте I/O — только «3.5 Pro».

2.2 Gemini 3.5 Flash (GA, эталон)

О Pro без Flash нельзя решить «ждать или нет»:

  • API ID: gemini-3.5-flash (GA, без суффикса preview)
  • Контекст: 1 048 576 входных / 65 536 выходных токенов (официальная документация)
  • Цены: $1,50 / $9,00 за миллион input/output; кэш входа $0,15
  • Дистрибуция: Gemini App, AI Mode in Search, Gemini API, AI Studio, Android Studio, Google Antigravity, Vertex AI, Gemini Enterprise
  • Возможности: мультимодальный ввод, function calling, выполнение кода, поисковые инструменты, динамический thinking

2.3 Gemini 3.5 Pro (превью / GA ожидается)

На 2026-07-13 публично подтверждено:

  • Google подтверждает, что Pro существует и используется внутри; публичный rollout сдвинут с «следующего месяца (июнь)».
  • Корпоративные клиенты Vertex AI — ограниченное превью (не self-service для всех).
  • Публичный список API: gemini-3.5-flash, gemini-3.1-pro-preview и др. — нет Pro GA model card.

Дифференциация Pro по прессе (проверить при GA):

  • Контекст 2M токенов — примерно вдвое больше Flash, для всего репозитория, длинных compliance-документов, длинных трасс агентов.
  • Слой Deep Think — многошаговая логика, сложная математика, планирование; привязка к тарифам подписки (см. цены).
  • Сильнее мультимодал и генерация UI — интерактивный web UI серии Gemini 3, hardest reasoning.
  • Низкая задержка не аргумент — Pro про качество, дополняет Flash, не заменяет.

3. График релиза: от I/O до середины июля

Дата Событие Достоверность
2026-05-19 Google I/O: Gemini 3.5; Flash GA; Pro внутри, публично «в следующем месяце» Официально
2026-05 ~ 06 Flash по умолчанию в Gemini App / Search AI Mode; Antigravity, Enterprise синхронно Официально
Конец июня 2026 Пресса: GA Pro с июня на июль; превью Vertex продолжается; в changelog API нет Pro GA Пресса + состояние API
2026-07-08 ~ 17 Несколько изданий: цель Google 17 июля GA; перестройка архитектуры и отзывы превью Пресса (не анонсировано)
2026-07-13 (дата статьи) Pro всё ещё не в публичном GA; разработчикам: Flash в проде, следить за changelog Фактическое состояние

Как отслеживать анонсы? Два источника: блог моделей Gemini / DeepMind и changelog Gemini API. В день GA обычно: model card, страница цен, дефолт в AI Studio. Только заголовок без этих трёх — считать превью.

4. Функции: подтверждено vs ожидается

Возможность Flash (GA) Pro (ожидается / пресса) Статус
Длинные агентские задачи Официальный фокус Сильнее рассуждение и планирование Flash подтверждён; Pro оценить после GA
Окно контекста 1M токенов 2M токенов (пресса) Flash официально; Pro не анонсирован
Deep Think / глубокое рассуждение Динамический thinking по умолчанию Отдельный слой Deep Think (пресса) Pro не анонсирован
Код / Terminal-Bench 76,2% (I/O) Ожидается выше Flash Flash с цифрой; Pro ожидается
Мультимодал Изображение, текст, аудио, видео Сильнее интерактивный UI (пресса) Flash подтверждён
Antigravity / Vertex Подключён В превью Flash GA; Pro enterprise-превью

Для разработчиков «ценность» функции зависит от типа задачи:

  • Code review + патч до 800K токенов: Flash обычно достаточно, затраты контролируемы.
  • Весь граф зависимостей + cross-service trace в одном выводе: 2M теоретически выгоден — ждать latency Pro и уровень галлюцинаций.
  • Многошаговая математика, сложный compliance: Deep Think как отдельный tier может быть близок к OpenAI reasoning.effort=max или Claude extended thinking.

5. Цена Gemini 3.5 Pro: официальный пробел и оценка

Google не опубликовал официальные цены API для Pro. Ниже по уровням — не принимать слухи за счёт.

5.1 Подтверждённый ориентир: Gemini 3.5 Flash

Позиция Цена (USD)
Входные токены $1,50 / млн (неглобальные регионы ~$1,65)
Выходные токены $9,00 / млн (неглобальные регионы ~$9,90)
Кэш входа $0,15 / млн

5.2 Цены Pro по прессе (не подтверждено)

Несколько изданий в одном порядке величины — только для бюджетной песочницы:

  • API: около $15 / млн вход, $60 / млн выход — ~10× Flash.
  • Потребительская подписка: Deep Think или полный Pro может требовать Gemini Advanced / Ultra (~$250/мес) (пресса, не страница цен Google).
  • Другие источники мягче (напр. $1,25 / $10) — противоречит гипотезе 10× — ориентир — model card в день GA.

5.3 Грубое сравнение с конкурентами (для решений, не live-котировки)

Слухи по Pro vs Flash и логика квот GPT-5.6 / Codex в одной рамке:

  • Частые агенты, миллионы токенов в день: Flash или GPT-5.6 Luna/Terra реалистичнее.
  • Редко, очень длинный контекст, один решающий вызов: Pro 2M может дать преимущество TCO (меньше вызовов за качество) — ждать официальные цены.
  • Терминальный coding-агент 24/7: кроме модели, среда выполнения (постоянно включённый облачный Mac) часто важнее, чем токен в 5× дороже.

6. Пять измерений: Pro (ожидается) vs Flash vs GPT-5.6 vs Claude

Измерение Gemini 3.5 Flash Gemini 3.5 Pro (ожидается) GPT-5.6 Sol Claude Mythos 5
Доступность GA, все каналы Превью / GA ожидается GA (2026-07) GA
Контекст 1M (официально) 2M (пресса) по тарифу / API ~200K+
Coding-агент Terminal-Bench 76,2% Ожидается Terminal-Bench 88,8% SWE-bench Pro лидирует
Цена API (порядок) $1,5 / $9 Слухи ~$15 / $60 Sol/Terra/Luna отдельно Средне-высокий сегмент
Лучший вход Antigravity / Gemini API Vertex + AI Studio (скоро) Codex / Cursor Claude Code CLI

Таблица не про «кто победил», а про то, что нет единого победителя по умолчанию. Flash в экосистеме Google уже «достаточно быстрый и дешёвый» как база агентов; Pro с 2M + Deep Think закроет очень длинные документы и жёсткое рассуждение; OpenAI и Anthropic сильнее в терминальном кодинге и IDE. См. гайд по выбору модели GPT-5.6 для кода.

7. Матрица сценариев

Сценарий Рекомендуется сейчас Переоценить после GA Pro Не рекомендуется
Дефолтный агент Antigravity 3.5 Flash Pro по задаче Ждать Pro и останавливать работу
Code review <1M токенов 3.5 Flash Насильно preview Pro
Анализ monorepo за один проход Flash + чанки / retrieval 3.5 Pro 2M Гонять локально на ноутбуке
Сложное финансовое / compliance-рассуждение Flash + ручная проверка Deep Think (если анонсируют) Длинный агент на free tier
CI-агент iOS / Xcode API Flash + облачный Mac Pro длинный контекст Только web UI без toolchain
Прод с SLA Flash GA + зафиксированная версия Pro GA + canary Привязка к дате из слухов

8. Рекомендуемые стеки

【Stack A — соло-разработчик / тест】
Модель: Gemini 3.5 Flash (AI Studio или API)
Вход: Antigravity или свой скрипт + function calling
Выполнение: короткое локально; длинное на облачном Mac
Бюджет: Flash $1,5/$9 на токены; не резервировать 10× Pro

【Stack B — Enterprise Vertex】
Модель: Flash прод + отдельный проект preview Pro
Governance: preview/prod разные service account; model ID в env
Мониторинг: RSS changelog + алерт по расходам (BigQuery billing export)
Переключение: после GA Pro 10% трафика canary → регрессия benchmark → полный rollout

【Stack C — команда с несколькими моделями】
Retrieval / большой репозиторий: Gemini 3.5 Flash
Жёсткое рассуждение / архитектурный review: ждать Pro или Claude extended thinking
Правки в терминале: Claude Code или Codex на worktree облачного Mac
IDE ежедневно: Cursor + GPT-5.6 Terra
Принцип: одна задача — одна «главная модель», без двойных токенов

9. Типичные ошибки

  • Ошибка 1: статья прессы = model card. 2M, Deep Think, $15/$60 нет в официальном тексте I/O — в архитектурных доках помечать «не подтверждено».
  • Ошибка 2: Flash — только переход. Данные I/O: Flash обгоняет 3.1 Pro в нескольких agent-benchmark — основная модель, не «/lite».
  • Ошибка 3: при выходе Pro переключить всех. Длиннее контекст ≠ ниже общая стоимость; неудачный вызов 2M может быть дороже.
  • Ошибка 4: игнорировать Antigravity vs API. Одна модель, разный harness — инструменты, права, задержка; тестировать на реальном входе.
  • Ошибка 5: ничего не деплоить, пока ждёте Pro. Конкуренты не ждут — pipeline на Flash ценнее двух недель простоя.

10. Внедрение в 7 шагов

  1. Инвентаризация задач: доля >1M контекста или жёсткого рассуждения; если <20%, Flash как основная модель.
  2. Прод-путь Flash: проект AI Studio или Vertex; API key / workload identity по средам.
  3. Абстракция model ID: GEMINI_MODEL=gemini-3.5-flash — без разбросанных хардкодов для switch при GA Pro.
  4. Длинные агенты на узел выполнения: многочасовые toolchains на облачном Mac — избегать сна локальной машины (ортогонально Flash/Pro, но критично).
  5. Подписка на changelog: Gemini API + блог Google AI; напоминание в календаре на середину/конец июля про GA.
  6. День GA Pro: прочитать model card → внутренний golden set → стоимость/качество vs Flash → canary 10%.
  7. Двухнедельный разбор: токены, успешность, ручные вмешательства — данные решают, стоит ли цена 10×.

11. FAQ

Вышел ли Gemini 3.5 Pro?

На 13 июля 2026 ещё не в публичном GA. Google объявил Pro на I/O 19 мая как внутренний с планом «следующий месяц» — сдвинут; корпоративные клиенты — ограниченное превью Vertex AI. Пресса называет 17 июля — Google дату не подтвердил.

Чем отличается Gemini 3.5 Pro от Flash?

Flash полностью доступен: быстрые агенты и код, 1M контекста, $1,50/$9 за миллион. Pro ожидается как flagship: пресса — 2M, Deep Think, выше цены API, сильнее многошаговые задачи — спецификации по model card GA.

Сколько стоит Gemini 3.5 Pro?

Google не опубликовал официальные цены Pro. Пресса: API ~$15/$60 за миллион input/output, ~10× Flash; Deep Think может требовать Ultra ~$250/мес. До официальной страницы цен — в контракт и бюджет только Flash.

Какую модель Gemini использовать сейчас?

В продакшене: Gemini 3.5 Flash (gemini-3.5-flash). Для агентов, Antigravity, оркестрации Enterprise в экосистеме Google Flash — дефолт 2026. Pro только в квалификации preview, изолированно от прод-трафика.

Стоит ли ждать Pro ради контекста 2M?

Зависит от задачи: если 1M + RAG/чанки закрывают 80%, ждать не нужно. Если регулярно заливаете весь репозиторий одним вызовом с высокой ценой retry — A/B после GA Pro. Не строить архитектуру на слухах про 2M до GA.

12. Итог

Что такое Gemini 3.5 Pro? — Флагман 3.5, анонсированный на I/O 2026 для самого сложного рассуждения и самого длинного контекста, к середине июля всё ещё не в публичном GA. Функции и цены: у Flash полная model card; ключевые цифры Pro 2M, Deep Think, $15/$60 — «правдоподобная пресса, не анонс». Сроки сдвинуты с «июня» на «середину/конец июля» — ориентир changelog API, не медийный обратный отсчёт.

Прагматичный путь один: сегодня Flash для агентов, завтра Pro как инкрементальное улучшение. Новости о моделях каждую неделю — команда фиксирует среду выполнения, абстракцию model ID и дашборд затрат — остальное менять, когда Sundar снова подпишет пост в блоге.

Пока ждёте Pro: стабилизируйте агента на Flash + облачном Mac

Gemini 3.5 Flash через API для coding-агентов — выполнение на облачном Mac mini M4: xcodebuild, Git worktree, SSH-сессии без обрыва. После GA Pro достаточно сменить model ID в переменных окружения — pipeline не перестраивать; единая память Apple Silicon для контекста 1M, изоляция macOS снижает риск действий агента с локальными файлами.

Сначала посуточная аренда для smoke-тестов Antigravity / Gemini API, затем месячная постоянная. kvmboot облачный Mac mini M4 — «Flash сегодня, Pro завтра»Смотреть тарифы и превратить ожидание GA в готовый agent pipeline.