Gemini 3.6 Flash

Gemini 3.6 Flash

Новая рабочая лошадка Google (21 июля 2026) - модель, которую компания выпустила вместо задержавшейся Gemini 3.5 Pro. Сильнее предшественницы в коде, экспертной работе и мультимодальности, при этом расходует на 17% меньше токенов и стоит дешевле: $1.50/$7.50 за 1M. Контекст 1M, вход - текст, изображения, видео, аудио и PDF.

API $1.50 / $7.50 за 1M токенов; входит в подписки Google AIНужен VPNРусский язык
⭐ 8.6/10📅 2026-07-21🏢 Google DeepMindProprietary

Рейтинг и бенчмарки

Общий рейтинг
8.6/10
Benchmark Score
8.6/10
Скорость
9/10
DeepSWE (кодинг)
49% против 37% у Gemini 3.5 Flash
OSWorld-Verified
83.0% против 78.4%
MLE-Bench
63.9% против 49.7%
Экономия токенов
на 17% меньше вывода, чем у 3.5 Flash
Скорость
~280 токенов/сек, знания до марта 2026

Входные и выходные данные

Входные данные
текстизображениевидеоаудиодокументы
Выходные данные
текст

API и стоимость

Входные токены (Input)
API $1.50 / $7.50 за 1M токенов; входит в подписки Google AI
цена за промпт
Выходные токены (Output)
$7.50 / 1M токенов
цена за ответ
✓API доступен

Способы доступа

API (Gemini APIGoogle AI Studio)Vertex AIприложение Gemini

Сценарии использования

повседневная рабочая нагрузкакодингагентные задачимультимодальный анализ (видеоаудиоPDF)обработка документов

Тарифы и подписки - Google DeepMind

Актуальные планы подписки провайдера. Цены могут меняться - уточняйте на странице цен

Приложение Gemini (Free)
Бесплатно
  • Доступ к Flash-моделям с дневными лимитами
  • Мультимодальные запросы
  • Web и мобильные приложения
Популярный
Google AI Pro
~$20/мес
  • Повышенные лимиты и приоритет
  • Доступ к старшим моделям Gemini
  • Интеграция с Google Workspace
API (pay-as-you-go)
$1.50 / $7.50 за 1M
  • Вход $1.50, выход $7.50 за 1M токенов
  • Кешированный вход - $0.15 за 1M
  • Контекст 1M, вывод до 64K
  • Google AI Studio и Vertex AI
Российские карты не принимаются.Genova-ai - работает в РФ без VPN

Плюсы и минусы

✓ Плюсы
Заметный скачок в кодинге: DeepSWE 49% против 37% у Gemini 3.5 Flash - почти треть прироста
Расходует на 17% меньше выходных токенов, чем предшественница, и стоит дешевле - двойная экономия на счете
Сильна в computer use и ML-задачах: OSWorld-Verified 83.0% и MLE-Bench 63.9% против 78.4% и 49.7% у 3.5 Flash
Богатый мультимодальный вход: текст, изображения, видео, аудио и PDF в одном запросе
Контекст 1M токенов и вывод до 64K - большие документы и длинные ответы
Быстрая: около 280 токенов в секунду, комфортно для интерактивной работы
Свежие знания - данные до марта 2026
✗ Минусы
Не работает в России без VPN - сервисы Google заблокированы для российских IP
Российские карты не принимаются ни для API, ни для подписок
Это Flash-класс: на самых сложных рассуждениях уступает Pro-моделям конкурентов (GPT-5.5, Claude Opus 5)
Дороже легкой Gemini 3.5 Flash-Lite примерно в 5 раз по входу - для массовых простых задач избыточна
Вышла как "замена" задержавшейся Gemini 3.5 Pro - полноценного нового флагмана Google так и не выпустила
Проприетарная и облачная, без локального запуска

Подробный обзор

Что такое Gemini 3.6 Flash

Gemini 3.6 Flash - модель Google DeepMind, выпущенная 21 июля 2026 года. Google называет ее своей "рабочей лошадкой" (workhorse model) - то есть основной моделью для повседневных задач. Важный контекст релиза: компания выпустила ее вместе с двумя другими Flash-моделями вместо давно ожидаемой Gemini 3.5 Pro, которая задержалась (по данным Bloomberg - из-за проблем с производительностью в кодинге). Для Google это была попытка ответить на релизы конкурентов тем, что уже готово.

Что улучшилось

  • Кодинг - DeepSWE 49% против 37% у Gemini 3.5 Flash, самый заметный прирост
  • Управление компьютером - OSWorld-Verified 83.0% против 78.4%
  • ML-задачи - MLE-Bench 63.9% против 49.7%
  • Экономичность - на 17% меньше выходных токенов при той же работе, плюс сама цена ниже, чем у предшественницы

Двойная экономия (дешевле тариф + меньше токенов) - главный практический аргумент модели для продакшна с большими объемами.

Характеристики и цены

Контекст - 1 миллион токенов, вывод до 64K, знания до марта 2026. Модель принимает текст, изображения, видео, аудио и PDF. Скорость около 280 токенов в секунду. Цена API: $1.50 за 1M входных и $7.50 за 1M выходных токенов, а кешированный вход стоит всего $0.15 за 1M - заметная экономия при повторяющихся системных промптах.

Доступность в России

Gemini 3.6 Flash не работает в России без VPN - приложение Gemini, Google AI Studio и API заблокированы для российских IP, а российские карты не принимаются. Доступ возможен через VPN с зарубежной картой либо через посредников с рублевой оплатой. Русский язык модель понимает и генерирует хорошо. Из работающих в России напрямую чат-моделей - YandexGPT и GigaChat.

Часто задаваемые вопросы

Что такое Gemini 3.6 Flash?
Основная "рабочая" модель Google, выпущенная 21 июля 2026 года. Она сильнее предшественницы Gemini 3.5 Flash в кодинге, экспертной работе и мультимодальности, при этом расходует на 17% меньше выходных токенов и стоит дешевле. Контекст 1M токенов, на входе - текст, изображения, видео, аудио и PDF.
Почему Google выпустила ее вместо Gemini 3.5 Pro?
Gemini 3.5 Pro задержалась: ее обещали еще в июне 2026, но релиз откладывался, а Bloomberg сообщал о трудностях с достижением внутренних целей по производительности (в частности, в кодинге). Вместо нее 21 июля Google выпустила три Flash-модели, включая 3.6 Flash. Полноценного нового Pro-флагмана на тот момент так и не появилось.
Насколько 3.6 Flash лучше 3.5 Flash?
Прирост заметный: DeepSWE (кодинг) - 49% против 37%, OSWorld-Verified (управление компьютером) - 83.0% против 78.4%, MLE-Bench - 63.9% против 49.7%. Плюс модель тратит на 17% меньше выходных токенов и стоит дешевле, так что экономия идет с двух сторон.
Сколько стоит Gemini 3.6 Flash?
Через API - $1.50 за 1M входных токенов и $7.50 за 1M выходных, кешированный вход всего $0.15 за 1M. Это дешевле предшественницы. В приложении Gemini есть бесплатный доступ с лимитами, а также подписки Google AI с повышенными лимитами.
Какие модальности поддерживает модель?
На входе - текст, изображения, видео, аудио и PDF-документы; на выходе текст. Контекстное окно 1 млн токенов, вывод до 64 тысяч. Это делает ее удобной для анализа больших разнородных материалов: например, разобрать длинный PDF или видеозапись встречи в одном запросе.
Работает ли Gemini 3.6 Flash в России?
Напрямую - нет: приложение Gemini, Google AI Studio и API заблокированы для российских IP, российские карты не принимаются. Нужен VPN с зарубежной картой либо посредник с рублевой оплатой. Русский язык модель понимает хорошо. Альтернативы, работающие в РФ, - YandexGPT и GigaChat.

Все эти инструменты - уже на Genova-ai

Картинки, видео, музыка, голос и ИИ-чат в одном месте. Без VPN и зарубежных карт.

Картинки
Видео
Музыка
Голос
ИИ-чат
Попробовать бесплатно