Gemini 3.6 Flash
Новая рабочая лошадка Google (21 июля 2026) - модель, которую компания выпустила вместо задержавшейся Gemini 3.5 Pro. Сильнее предшественницы в коде, экспертной работе и мультимодальности, при этом расходует на 17% меньше токенов и стоит дешевле: $1.50/$7.50 за 1M. Контекст 1M, вход - текст, изображения, видео, аудио и PDF.
Рейтинг и бенчмарки
Входные и выходные данные
API и стоимость
Способы доступа
Сценарии использования
Тарифы и подписки - Google DeepMind
Актуальные планы подписки провайдера. Цены могут меняться - уточняйте на странице цен
- Доступ к Flash-моделям с дневными лимитами
- Мультимодальные запросы
- Web и мобильные приложения
- Повышенные лимиты и приоритет
- Доступ к старшим моделям Gemini
- Интеграция с Google Workspace
- Вход $1.50, выход $7.50 за 1M токенов
- Кешированный вход - $0.15 за 1M
- Контекст 1M, вывод до 64K
- Google AI Studio и Vertex AI
Плюсы и минусы
Подробный обзор
Что такое Gemini 3.6 Flash
Gemini 3.6 Flash - модель Google DeepMind, выпущенная 21 июля 2026 года. Google называет ее своей "рабочей лошадкой" (workhorse model) - то есть основной моделью для повседневных задач. Важный контекст релиза: компания выпустила ее вместе с двумя другими Flash-моделями вместо давно ожидаемой Gemini 3.5 Pro, которая задержалась (по данным Bloomberg - из-за проблем с производительностью в кодинге). Для Google это была попытка ответить на релизы конкурентов тем, что уже готово.
Что улучшилось
- Кодинг - DeepSWE 49% против 37% у Gemini 3.5 Flash, самый заметный прирост
- Управление компьютером - OSWorld-Verified 83.0% против 78.4%
- ML-задачи - MLE-Bench 63.9% против 49.7%
- Экономичность - на 17% меньше выходных токенов при той же работе, плюс сама цена ниже, чем у предшественницы
Двойная экономия (дешевле тариф + меньше токенов) - главный практический аргумент модели для продакшна с большими объемами.
Характеристики и цены
Контекст - 1 миллион токенов, вывод до 64K, знания до марта 2026. Модель принимает текст, изображения, видео, аудио и PDF. Скорость около 280 токенов в секунду. Цена API: $1.50 за 1M входных и $7.50 за 1M выходных токенов, а кешированный вход стоит всего $0.15 за 1M - заметная экономия при повторяющихся системных промптах.
Доступность в России
Gemini 3.6 Flash не работает в России без VPN - приложение Gemini, Google AI Studio и API заблокированы для российских IP, а российские карты не принимаются. Доступ возможен через VPN с зарубежной картой либо через посредников с рублевой оплатой. Русский язык модель понимает и генерирует хорошо. Из работающих в России напрямую чат-моделей - YandexGPT и GigaChat.