Ключевые выводы
- Официально подтверждено: 19 мая 2026 на I/O представлено семейство Gemini 3.5; Gemini 3.5 Flash в GA в тот же день; Pro используется внутри компании, публичный rollout планировался «в следующем месяце» — срок сдвинут.
- На 13 июля: Pro всё ещё в корпоративном превью Vertex AI; в публичном API нет GA-записи
gemini-3.5-pro; СМИ называют целью 17 июля — Google не подтвердил. - Не подтверждено официально, но широко в прессе: контекст 2M токенов, слой Deep Think, API ~$15/$60 за миллион токенов, подписка Ultra ~$250/мес.
- Уже доступно: Gemini 3.5 Flash (1M контекста, $1,50/$9 за миллион) покрывает большинство сценариев агентов и кодинга.
- Критерий выбора — не «кто умнее», а длина контекста × стоимость рассуждений × среда выполнения — длинные агенты лучше крутить на облачном Mac 24/7.
Предварительный вывод: Flash работает сегодня, Pro стоит ждать — но не для продакшена
Пока Google не опубликовал официальную model card, все цифры по Pro — ставки, а не условия договора.
Три фразы на запоминание: ① Gemini 3.5 Flash — уже дефолт Google для разработчиков в 2026; ② Gemini 3.5 Pro — «тяжёлая артиллерия» семейства, но к середине июля всё ещё не в публичном GA; ③ привязывать прод к дате «вроде 17 июля» рискованнее, чем выгодно.
В официальном блоге Google сдержан: семейство 3.5 — «frontier intelligence with action», агенты и код; Flash сразу доступен; Pro «внутри компании, публичный запуск ожидается в следующем месяце». Sundar Pichai на сцене I/O — та же линия. В официальном тексте нет 2M контекста, Deep Think и цен API — это пресса и утечки из enterprise-превью, нужен уровень доверия.
Прагматично для инженеров: Flash для Antigravity / Gemini API / Vertex-агентов, задачи «2M токенов весь репозиторий» или «жёсткое многошаговое рассуждение» — в backlog, смена дефолтной модели — когда в changelog Gemini API появится GA. Как в нашем гайде по GPT-5.6 и Gemini: релизы моделей учащаются — сначала фиксируйте вход workflow и узел выполнения.
1. Почему Gemini 3.5 Pro «задерживается» сильнее Flash?
GA Flash в день I/O — не случайность. Google позиционирует 3.5 Flash как дефолт высокой пропускной способности, приоритет агентов: 1M контекста, динамический thinking по умолчанию, Terminal-Bench 2.1 76,2% в списке анонсов I/O. Цель — показать, что «Flash тянет flagship» — важно для поиска, Gemini App и дефолта Antigravity.
У Pro другая роль. Пресса (Business Insider, Geeky Gadgets и др.) пишет: в enterprise-превью эффективность токенов и качество на длинных агентских задачах не достигли внутренней планки — перестройка архитектуры, GA сдвинут с июня на июль, в статьях цель 17 июля. Google не комментирует даты — «17 июля» — окно отраслевого консенсуса, не обещание SLA.
Где провалился старый план? Многие после I/O записали «в июне полный переход на Pro»:
- Бюджет зафиксирован под «слухи $15/$60», а в июне биллится только Flash — финмодель искажена.
- Промпты и toolchains в Vertex-превью без абстракции model ID — переделка при GA.
- «2M весь репозиторий за раз» как архитектурная предпосылка — Flash 1M + retrieval/чанки часто дают 80%.
- Длинный агент на ноутбуке: крышка закрыта — связь оборвана; не вина Pro, но списывают на задержку релиза.
Урок: Google лучше подождёт месяц, чем выпустит «наследника Ultra» ниже планки и ударит по бренду. Сигнал: Flash уже силён — Pro должен быть заметно сильнее для своей ценовой ступени.
2. Что такое Gemini 3.5 Pro? Отличие от Flash
2.1 Позиционирование семейства (официально)
По Google, Gemini 3.5 — новое семейство 2026 с фокусом агенты, код, длинные задачи. Flash: «дефолт, скорость, широкое покрытие»; Pro: «самое сложное рассуждение, самый длинный контекст, максимальное качество» — наследник Gemini Ultra / 3.1 Pro, без формулировки «Ultra переименован» в тексте I/O — только «3.5 Pro».
2.2 Gemini 3.5 Flash (GA, эталон)
О Pro без Flash нельзя решить «ждать или нет»:
- API ID:
gemini-3.5-flash(GA, без суффикса preview) - Контекст: 1 048 576 входных / 65 536 выходных токенов (официальная документация)
- Цены: $1,50 / $9,00 за миллион input/output; кэш входа $0,15
- Дистрибуция: Gemini App, AI Mode in Search, Gemini API, AI Studio, Android Studio, Google Antigravity, Vertex AI, Gemini Enterprise
- Возможности: мультимодальный ввод, function calling, выполнение кода, поисковые инструменты, динамический thinking
2.3 Gemini 3.5 Pro (превью / GA ожидается)
На 2026-07-13 публично подтверждено:
- Google подтверждает, что Pro существует и используется внутри; публичный rollout сдвинут с «следующего месяца (июнь)».
- Корпоративные клиенты Vertex AI — ограниченное превью (не self-service для всех).
- Публичный список API:
gemini-3.5-flash,gemini-3.1-pro-previewи др. — нет Pro GA model card.
Дифференциация Pro по прессе (проверить при GA):
- Контекст 2M токенов — примерно вдвое больше Flash, для всего репозитория, длинных compliance-документов, длинных трасс агентов.
- Слой Deep Think — многошаговая логика, сложная математика, планирование; привязка к тарифам подписки (см. цены).
- Сильнее мультимодал и генерация UI — интерактивный web UI серии Gemini 3, hardest reasoning.
- Низкая задержка не аргумент — Pro про качество, дополняет Flash, не заменяет.
3. График релиза: от I/O до середины июля
| Дата | Событие | Достоверность |
|---|---|---|
| 2026-05-19 | Google I/O: Gemini 3.5; Flash GA; Pro внутри, публично «в следующем месяце» | Официально |
| 2026-05 ~ 06 | Flash по умолчанию в Gemini App / Search AI Mode; Antigravity, Enterprise синхронно | Официально |
| Конец июня 2026 | Пресса: GA Pro с июня на июль; превью Vertex продолжается; в changelog API нет Pro GA | Пресса + состояние API |
| 2026-07-08 ~ 17 | Несколько изданий: цель Google 17 июля GA; перестройка архитектуры и отзывы превью | Пресса (не анонсировано) |
| 2026-07-13 (дата статьи) | Pro всё ещё не в публичном GA; разработчикам: Flash в проде, следить за changelog | Фактическое состояние |
Как отслеживать анонсы? Два источника: блог моделей Gemini / DeepMind и changelog Gemini API. В день GA обычно: model card, страница цен, дефолт в AI Studio. Только заголовок без этих трёх — считать превью.
4. Функции: подтверждено vs ожидается
| Возможность | Flash (GA) | Pro (ожидается / пресса) | Статус |
|---|---|---|---|
| Длинные агентские задачи | Официальный фокус | Сильнее рассуждение и планирование | Flash подтверждён; Pro оценить после GA |
| Окно контекста | 1M токенов | 2M токенов (пресса) | Flash официально; Pro не анонсирован |
| Deep Think / глубокое рассуждение | Динамический thinking по умолчанию | Отдельный слой Deep Think (пресса) | Pro не анонсирован |
| Код / Terminal-Bench | 76,2% (I/O) | Ожидается выше Flash | Flash с цифрой; Pro ожидается |
| Мультимодал | Изображение, текст, аудио, видео | Сильнее интерактивный UI (пресса) | Flash подтверждён |
| Antigravity / Vertex | Подключён | В превью | Flash GA; Pro enterprise-превью |
Для разработчиков «ценность» функции зависит от типа задачи:
- Code review + патч до 800K токенов: Flash обычно достаточно, затраты контролируемы.
- Весь граф зависимостей + cross-service trace в одном выводе: 2M теоретически выгоден — ждать latency Pro и уровень галлюцинаций.
- Многошаговая математика, сложный compliance: Deep Think как отдельный tier может быть близок к OpenAI
reasoning.effort=maxили Claude extended thinking.
5. Цена Gemini 3.5 Pro: официальный пробел и оценка
Google не опубликовал официальные цены API для Pro. Ниже по уровням — не принимать слухи за счёт.
5.1 Подтверждённый ориентир: Gemini 3.5 Flash
| Позиция | Цена (USD) |
|---|---|
| Входные токены | $1,50 / млн (неглобальные регионы ~$1,65) |
| Выходные токены | $9,00 / млн (неглобальные регионы ~$9,90) |
| Кэш входа | $0,15 / млн |
5.2 Цены Pro по прессе (не подтверждено)
Несколько изданий в одном порядке величины — только для бюджетной песочницы:
- API: около $15 / млн вход, $60 / млн выход — ~10× Flash.
- Потребительская подписка: Deep Think или полный Pro может требовать Gemini Advanced / Ultra (~$250/мес) (пресса, не страница цен Google).
- Другие источники мягче (напр. $1,25 / $10) — противоречит гипотезе 10× — ориентир — model card в день GA.
5.3 Грубое сравнение с конкурентами (для решений, не live-котировки)
Слухи по Pro vs Flash и логика квот GPT-5.6 / Codex в одной рамке:
- Частые агенты, миллионы токенов в день: Flash или GPT-5.6 Luna/Terra реалистичнее.
- Редко, очень длинный контекст, один решающий вызов: Pro 2M может дать преимущество TCO (меньше вызовов за качество) — ждать официальные цены.
- Терминальный coding-агент 24/7: кроме модели, среда выполнения (постоянно включённый облачный Mac) часто важнее, чем токен в 5× дороже.
6. Пять измерений: Pro (ожидается) vs Flash vs GPT-5.6 vs Claude
| Измерение | Gemini 3.5 Flash | Gemini 3.5 Pro (ожидается) | GPT-5.6 Sol | Claude Mythos 5 |
|---|---|---|---|---|
| Доступность | GA, все каналы | Превью / GA ожидается | GA (2026-07) | GA |
| Контекст | 1M (официально) | 2M (пресса) | по тарифу / API | ~200K+ |
| Coding-агент | Terminal-Bench 76,2% | Ожидается | Terminal-Bench 88,8% | SWE-bench Pro лидирует |
| Цена API (порядок) | $1,5 / $9 | Слухи ~$15 / $60 | Sol/Terra/Luna отдельно | Средне-высокий сегмент |
| Лучший вход | Antigravity / Gemini API | Vertex + AI Studio (скоро) | Codex / Cursor | Claude Code CLI |
Таблица не про «кто победил», а про то, что нет единого победителя по умолчанию. Flash в экосистеме Google уже «достаточно быстрый и дешёвый» как база агентов; Pro с 2M + Deep Think закроет очень длинные документы и жёсткое рассуждение; OpenAI и Anthropic сильнее в терминальном кодинге и IDE. См. гайд по выбору модели GPT-5.6 для кода.
7. Матрица сценариев
| Сценарий | Рекомендуется сейчас | Переоценить после GA Pro | Не рекомендуется |
|---|---|---|---|
| Дефолтный агент Antigravity | 3.5 Flash | Pro по задаче | Ждать Pro и останавливать работу |
| Code review <1M токенов | 3.5 Flash | — | Насильно preview Pro |
| Анализ monorepo за один проход | Flash + чанки / retrieval | 3.5 Pro 2M | Гонять локально на ноутбуке |
| Сложное финансовое / compliance-рассуждение | Flash + ручная проверка | Deep Think (если анонсируют) | Длинный агент на free tier |
| CI-агент iOS / Xcode | API Flash + облачный Mac | Pro длинный контекст | Только web UI без toolchain |
| Прод с SLA | Flash GA + зафиксированная версия | Pro GA + canary | Привязка к дате из слухов |
8. Рекомендуемые стеки
【Stack A — соло-разработчик / тест】
Модель: Gemini 3.5 Flash (AI Studio или API)
Вход: Antigravity или свой скрипт + function calling
Выполнение: короткое локально; длинное на облачном Mac
Бюджет: Flash $1,5/$9 на токены; не резервировать 10× Pro
【Stack B — Enterprise Vertex】
Модель: Flash прод + отдельный проект preview Pro
Governance: preview/prod разные service account; model ID в env
Мониторинг: RSS changelog + алерт по расходам (BigQuery billing export)
Переключение: после GA Pro 10% трафика canary → регрессия benchmark → полный rollout
【Stack C — команда с несколькими моделями】
Retrieval / большой репозиторий: Gemini 3.5 Flash
Жёсткое рассуждение / архитектурный review: ждать Pro или Claude extended thinking
Правки в терминале: Claude Code или Codex на worktree облачного Mac
IDE ежедневно: Cursor + GPT-5.6 Terra
Принцип: одна задача — одна «главная модель», без двойных токенов
9. Типичные ошибки
- Ошибка 1: статья прессы = model card. 2M, Deep Think, $15/$60 нет в официальном тексте I/O — в архитектурных доках помечать «не подтверждено».
- Ошибка 2: Flash — только переход. Данные I/O: Flash обгоняет 3.1 Pro в нескольких agent-benchmark — основная модель, не «/lite».
- Ошибка 3: при выходе Pro переключить всех. Длиннее контекст ≠ ниже общая стоимость; неудачный вызов 2M может быть дороже.
- Ошибка 4: игнорировать Antigravity vs API. Одна модель, разный harness — инструменты, права, задержка; тестировать на реальном входе.
- Ошибка 5: ничего не деплоить, пока ждёте Pro. Конкуренты не ждут — pipeline на Flash ценнее двух недель простоя.
10. Внедрение в 7 шагов
- Инвентаризация задач: доля >1M контекста или жёсткого рассуждения; если <20%, Flash как основная модель.
- Прод-путь Flash: проект AI Studio или Vertex; API key / workload identity по средам.
- Абстракция model ID:
GEMINI_MODEL=gemini-3.5-flash— без разбросанных хардкодов для switch при GA Pro. - Длинные агенты на узел выполнения: многочасовые toolchains на облачном Mac — избегать сна локальной машины (ортогонально Flash/Pro, но критично).
- Подписка на changelog: Gemini API + блог Google AI; напоминание в календаре на середину/конец июля про GA.
- День GA Pro: прочитать model card → внутренний golden set → стоимость/качество vs Flash → canary 10%.
- Двухнедельный разбор: токены, успешность, ручные вмешательства — данные решают, стоит ли цена 10×.
11. FAQ
Вышел ли Gemini 3.5 Pro?
На 13 июля 2026 ещё не в публичном GA. Google объявил Pro на I/O 19 мая как внутренний с планом «следующий месяц» — сдвинут; корпоративные клиенты — ограниченное превью Vertex AI. Пресса называет 17 июля — Google дату не подтвердил.
Чем отличается Gemini 3.5 Pro от Flash?
Flash полностью доступен: быстрые агенты и код, 1M контекста, $1,50/$9 за миллион. Pro ожидается как flagship: пресса — 2M, Deep Think, выше цены API, сильнее многошаговые задачи — спецификации по model card GA.
Сколько стоит Gemini 3.5 Pro?
Google не опубликовал официальные цены Pro. Пресса: API ~$15/$60 за миллион input/output, ~10× Flash; Deep Think может требовать Ultra ~$250/мес. До официальной страницы цен — в контракт и бюджет только Flash.
Какую модель Gemini использовать сейчас?
В продакшене: Gemini 3.5 Flash (gemini-3.5-flash). Для агентов, Antigravity, оркестрации Enterprise в экосистеме Google Flash — дефолт 2026. Pro только в квалификации preview, изолированно от прод-трафика.
Стоит ли ждать Pro ради контекста 2M?
Зависит от задачи: если 1M + RAG/чанки закрывают 80%, ждать не нужно. Если регулярно заливаете весь репозиторий одним вызовом с высокой ценой retry — A/B после GA Pro. Не строить архитектуру на слухах про 2M до GA.
12. Итог
Что такое Gemini 3.5 Pro? — Флагман 3.5, анонсированный на I/O 2026 для самого сложного рассуждения и самого длинного контекста, к середине июля всё ещё не в публичном GA. Функции и цены: у Flash полная model card; ключевые цифры Pro 2M, Deep Think, $15/$60 — «правдоподобная пресса, не анонс». Сроки сдвинуты с «июня» на «середину/конец июля» — ориентир changelog API, не медийный обратный отсчёт.
Прагматичный путь один: сегодня Flash для агентов, завтра Pro как инкрементальное улучшение. Новости о моделях каждую неделю — команда фиксирует среду выполнения, абстракцию model ID и дашборд затрат — остальное менять, когда Sundar снова подпишет пост в блоге.
Пока ждёте Pro: стабилизируйте агента на Flash + облачном Mac
Gemini 3.5 Flash через API для coding-агентов — выполнение на облачном Mac mini M4: xcodebuild, Git worktree, SSH-сессии без обрыва. После GA Pro достаточно сменить model ID в переменных окружения — pipeline не перестраивать; единая память Apple Silicon для контекста 1M, изоляция macOS снижает риск действий агента с локальными файлами.
Сначала посуточная аренда для smoke-тестов Antigravity / Gemini API, затем месячная постоянная. kvmboot облачный Mac mini M4 — «Flash сегодня, Pro завтра» — Смотреть тарифы и превратить ожидание GA в готовый agent pipeline.