Gemini 3.6 Flash

Gemini 3.6 Flash

Новая рабочая лошадка Google (21 июля 2026) — модель, которую компания выпустила вместо задержавшейся Gemini 3.5 Pro. Сильнее предшественницы в коде, экспертной работе и мультимодальности, при этом расходует на 17% меньше токенов и стоит дешевле: $1.50/$7.50 за 1M. Контекст 1M, вход — текст, изображения, видео, аудио и PDF.

API $1.50 / $7.50 за 1M токенов; входит в подписки Google AIНужен VPNРусский язык
8.6/10📅 2026-07-21🏢 Google DeepMindProprietary

Рейтинг и бенчмарки

Общий рейтинг
8.6/10
Benchmark Score
8.6/10
Скорость
9/10
DeepSWE (кодинг)
49% против 37% у Gemini 3.5 Flash
OSWorld-Verified
83.0% против 78.4%
MLE-Bench
63.9% против 49.7%
Экономия токенов
на 17% меньше вывода, чем у 3.5 Flash
Скорость
~280 токенов/сек, знания до марта 2026

Входные и выходные данные

Входные данные
текстизображениевидеоаудиодокументы
Выходные данные
текст

API и стоимость

Входные токены (Input)
API $1.50 / $7.50 за 1M токенов; входит в подписки Google AI
цена за промпт
Выходные токены (Output)
$7.50 / 1M токенов
цена за ответ
API доступен

Способы доступа

API (Gemini APIGoogle AI Studio)Vertex AIприложение Gemini

Сценарии использования

повседневная рабочая нагрузкакодингагентные задачимультимодальный анализ (видеоаудиоPDF)обработка документов

Тарифы и подписки — Google DeepMind

Актуальные планы подписки провайдера. Цены могут меняться — уточняйте на странице цен

Приложение Gemini (Free)
Бесплатно
  • Доступ к Flash-моделям с дневными лимитами
  • Мультимодальные запросы
  • Web и мобильные приложения
Популярный
Google AI Pro
~$20/мес
  • Повышенные лимиты и приоритет
  • Доступ к старшим моделям Gemini
  • Интеграция с Google Workspace
API (pay-as-you-go)
$1.50 / $7.50 за 1M
  • Вход $1.50, выход $7.50 за 1M токенов
  • Кешированный вход — $0.15 за 1M
  • Контекст 1M, вывод до 64K
  • Google AI Studio и Vertex AI
Российские карты не принимаются.Genova-ai — работает в РФ без VPN

Плюсы и минусы

✓ Плюсы
Заметный скачок в кодинге: DeepSWE 49% против 37% у Gemini 3.5 Flash — почти треть прироста
Расходует на 17% меньше выходных токенов, чем предшественница, и стоит дешевле — двойная экономия на счёте
Сильна в computer use и ML-задачах: OSWorld-Verified 83.0% и MLE-Bench 63.9% против 78.4% и 49.7% у 3.5 Flash
Богатый мультимодальный вход: текст, изображения, видео, аудио и PDF в одном запросе
Контекст 1M токенов и вывод до 64K — большие документы и длинные ответы
Быстрая: около 280 токенов в секунду, комфортно для интерактивной работы
Свежие знания — данные до марта 2026
✗ Минусы
Не работает в России без VPN — сервисы Google заблокированы для российских IP
Российские карты не принимаются ни для API, ни для подписок
Это Flash-класс: на самых сложных рассуждениях уступает Pro-моделям конкурентов (GPT-5.5, Claude Opus 5)
Дороже лёгкой Gemini 3.5 Flash-Lite примерно в 5 раз по входу — для массовых простых задач избыточна
Вышла как «замена» задержавшейся Gemini 3.5 Pro — полноценного нового флагмана Google так и не выпустила
Проприетарная и облачная, без локального запуска

Подробный обзор

Что такое Gemini 3.6 Flash

Gemini 3.6 Flash — модель Google DeepMind, выпущенная 21 июля 2026 года. Google называет её своей «рабочей лошадкой» (workhorse model) — то есть основной моделью для повседневных задач. Важный контекст релиза: компания выпустила её вместе с двумя другими Flash-моделями вместо давно ожидаемой Gemini 3.5 Pro, которая задержалась (по данным Bloomberg — из-за проблем с производительностью в кодинге). Для Google это была попытка ответить на релизы конкурентов тем, что уже готово.

Что улучшилось

  • Кодинг — DeepSWE 49% против 37% у Gemini 3.5 Flash, самый заметный прирост
  • Управление компьютером — OSWorld-Verified 83.0% против 78.4%
  • ML-задачи — MLE-Bench 63.9% против 49.7%
  • Экономичность — на 17% меньше выходных токенов при той же работе, плюс сама цена ниже, чем у предшественницы

Двойная экономия (дешевле тариф + меньше токенов) — главный практический аргумент модели для продакшна с большими объёмами.

Характеристики и цены

Контекст — 1 миллион токенов, вывод до 64K, знания до марта 2026. Модель принимает текст, изображения, видео, аудио и PDF. Скорость около 280 токенов в секунду. Цена API: $1.50 за 1M входных и $7.50 за 1M выходных токенов, а кешированный вход стоит всего $0.15 за 1M — заметная экономия при повторяющихся системных промптах.

Доступность в России

Gemini 3.6 Flash не работает в России без VPN — приложение Gemini, Google AI Studio и API заблокированы для российских IP, а российские карты не принимаются. Доступ возможен через VPN с зарубежной картой либо через посредников с рублёвой оплатой. Русский язык модель понимает и генерирует хорошо. Из работающих в России напрямую чат-моделей — YandexGPT и GigaChat.

Часто задаваемые вопросы

Что такое Gemini 3.6 Flash?
Основная «рабочая» модель Google, выпущенная 21 июля 2026 года. Она сильнее предшественницы Gemini 3.5 Flash в кодинге, экспертной работе и мультимодальности, при этом расходует на 17% меньше выходных токенов и стоит дешевле. Контекст 1M токенов, на входе — текст, изображения, видео, аудио и PDF.
Почему Google выпустила её вместо Gemini 3.5 Pro?
Gemini 3.5 Pro задержалась: её обещали ещё в июне 2026, но релиз откладывался, а Bloomberg сообщал о трудностях с достижением внутренних целей по производительности (в частности, в кодинге). Вместо неё 21 июля Google выпустила три Flash-модели, включая 3.6 Flash. Полноценного нового Pro-флагмана на тот момент так и не появилось.
Насколько 3.6 Flash лучше 3.5 Flash?
Прирост заметный: DeepSWE (кодинг) — 49% против 37%, OSWorld-Verified (управление компьютером) — 83.0% против 78.4%, MLE-Bench — 63.9% против 49.7%. Плюс модель тратит на 17% меньше выходных токенов и стоит дешевле, так что экономия идёт с двух сторон.
Сколько стоит Gemini 3.6 Flash?
Через API — $1.50 за 1M входных токенов и $7.50 за 1M выходных, кешированный вход всего $0.15 за 1M. Это дешевле предшественницы. В приложении Gemini есть бесплатный доступ с лимитами, а также подписки Google AI с повышенными лимитами.
Какие модальности поддерживает модель?
На входе — текст, изображения, видео, аудио и PDF-документы; на выходе текст. Контекстное окно 1 млн токенов, вывод до 64 тысяч. Это делает её удобной для анализа больших разнородных материалов: например, разобрать длинный PDF или видеозапись встречи в одном запросе.
Работает ли Gemini 3.6 Flash в России?
Напрямую — нет: приложение Gemini, Google AI Studio и API заблокированы для российских IP, российские карты не принимаются. Нужен VPN с зарубежной картой либо посредник с рублёвой оплатой. Русский язык модель понимает хорошо. Альтернативы, работающие в РФ, — YandexGPT и GigaChat.

Все эти инструменты — уже на Genova-ai

Картинки, видео, музыка, голос и ИИ-чат в одном месте. Без VPN и зарубежных карт.

Картинки
Видео
Музыка
Голос
ИИ-чат
Попробовать бесплатно