Gemini 3.6 Flash
Новая рабочая лошадка Google (21 июля 2026) — модель, которую компания выпустила вместо задержавшейся Gemini 3.5 Pro. Сильнее предшественницы в коде, экспертной работе и мультимодальности, при этом расходует на 17% меньше токенов и стоит дешевле: $1.50/$7.50 за 1M. Контекст 1M, вход — текст, изображения, видео, аудио и PDF.
Рейтинг и бенчмарки
Входные и выходные данные
API и стоимость
Способы доступа
Сценарии использования
Тарифы и подписки — Google DeepMind
Актуальные планы подписки провайдера. Цены могут меняться — уточняйте на странице цен
- Доступ к Flash-моделям с дневными лимитами
- Мультимодальные запросы
- Web и мобильные приложения
- Повышенные лимиты и приоритет
- Доступ к старшим моделям Gemini
- Интеграция с Google Workspace
- Вход $1.50, выход $7.50 за 1M токенов
- Кешированный вход — $0.15 за 1M
- Контекст 1M, вывод до 64K
- Google AI Studio и Vertex AI
Плюсы и минусы
Подробный обзор
Что такое Gemini 3.6 Flash
Gemini 3.6 Flash — модель Google DeepMind, выпущенная 21 июля 2026 года. Google называет её своей «рабочей лошадкой» (workhorse model) — то есть основной моделью для повседневных задач. Важный контекст релиза: компания выпустила её вместе с двумя другими Flash-моделями вместо давно ожидаемой Gemini 3.5 Pro, которая задержалась (по данным Bloomberg — из-за проблем с производительностью в кодинге). Для Google это была попытка ответить на релизы конкурентов тем, что уже готово.
Что улучшилось
- Кодинг — DeepSWE 49% против 37% у Gemini 3.5 Flash, самый заметный прирост
- Управление компьютером — OSWorld-Verified 83.0% против 78.4%
- ML-задачи — MLE-Bench 63.9% против 49.7%
- Экономичность — на 17% меньше выходных токенов при той же работе, плюс сама цена ниже, чем у предшественницы
Двойная экономия (дешевле тариф + меньше токенов) — главный практический аргумент модели для продакшна с большими объёмами.
Характеристики и цены
Контекст — 1 миллион токенов, вывод до 64K, знания до марта 2026. Модель принимает текст, изображения, видео, аудио и PDF. Скорость около 280 токенов в секунду. Цена API: $1.50 за 1M входных и $7.50 за 1M выходных токенов, а кешированный вход стоит всего $0.15 за 1M — заметная экономия при повторяющихся системных промптах.
Доступность в России
Gemini 3.6 Flash не работает в России без VPN — приложение Gemini, Google AI Studio и API заблокированы для российских IP, а российские карты не принимаются. Доступ возможен через VPN с зарубежной картой либо через посредников с рублёвой оплатой. Русский язык модель понимает и генерирует хорошо. Из работающих в России напрямую чат-моделей — YandexGPT и GigaChat.