Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite

Самая быстрая и дешёвая модель линейки Gemini 3.5 (21 июля 2026): $0.30/$2.50 за 1M токенов — впятеро дешевле по входу, чем Gemini 3.6 Flash. Выдаёт около 460 токенов в секунду, контекст 1M, вход текст/изображения/речь/видео. Создана под массовые задачи: поиск, обработку документов и перевод.

API $0.30 / $2.50 за 1M (batch и flex — вдвое дешевле)Нужен VPNРусский язык
7.9/10📅 2026-07-21🏢 Google DeepMindProprietary

Рейтинг и бенчмарки

Общий рейтинг
7.9/10
Benchmark Score
7.6/10
Скорость
9.5/10
Цена
$0.30 / $2.50 за 1M — в 5 раз дешевле по входу, чем 3.6 Flash
Скорость
~462 токена/сек — заметно выше среднего в классе
Artificial Analysis Intelligence Index
36 — выше среднего среди reasoning-моделей своей ценовой категории
Задержка первого токена
~8.9 сек — высокая для класса
Контекст
1M токенов

Входные и выходные данные

Входные данные
текстизображениеаудиовидео
Выходные данные
текст

API и стоимость

Входные токены (Input)
API $0.30 / $2.50 за 1M (batch и flex — вдвое дешевле)
цена за промпт
Выходные токены (Output)
$2.50 / 1M токенов
цена за ответ
API доступен

Способы доступа

API (Gemini APIGoogle AI Studio)Vertex AI

Сценарии использования

высоконагруженные задачипоиск и извлечение данныхобработка документовпереводклассификациялёгкие агенты

Тарифы и подписки — Google DeepMind

Актуальные планы подписки провайдера. Цены могут меняться — уточняйте на странице цен

Популярный
API (стандарт)
$0.30 / $2.50 за 1M
  • Вход $0.30, выход $2.50 за 1M токенов
  • Контекст 1M
  • Мультимодальный вход
  • Google AI Studio и Vertex AI
API (batch / flex)
$0.15 / $1.25 за 1M
  • Вдвое дешевле стандартного тарифа
  • Для офлайн и фоновой обработки
  • Максимальная экономия на объёмах
Бесплатный уровень
Бесплатно
  • Тестирование в Google AI Studio
  • Дневные лимиты
  • Без оплаты на старте
Российские карты не принимаются.Genova-ai — работает в РФ без VPN

Плюсы и минусы

✓ Плюсы
Самая дешёвая в линейке 3.5: $0.30/$2.50 за 1M — впятеро дешевле по входу и втрое по выходу, чем Gemini 3.6 Flash
Очень высокая скорость генерации — около 462 токенов в секунду, заметно выше среднего в своём классе
Batch и flex-режимы удешевляют ещё вдвое ($0.15/$1.25) — выгодно для офлайн-обработки больших объёмов
Умный для своей цены: 36 в Artificial Analysis Intelligence Index — выше среднего среди reasoning-моделей той же ценовой категории
Контекст 1M токенов и мультимодальный вход (текст, изображения, речь, видео) даже в самом бюджетном тире
Идеальна под массовые сценарии: поиск, извлечение и обработка документов, перевод, классификация
✗ Минусы
Высокая задержка до первого токена — около 8.9 секунды, что много для интерактивных чатов; лучше для фоновой обработки
Не работает в России без VPN — сервисы Google заблокированы для российских IP
Российские карты не принимаются ни для API, ни для подписок
Заточена под простые массовые задачи: на сложных рассуждениях уступает 3.6 Flash и Pro-моделям
Проприетарная и облачная — без локального запуска
Вышла в один день с 3.6 Flash и 3.5 Flash Cyber — в линейке Gemini легко запутаться в версиях

Подробный обзор

Что такое Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite — самая быстрая и дешёвая модель линейки Gemini 3.5, выпущенная 21 июля 2026 года вместе с Gemini 3.6 Flash и специализированной 3.5 Flash Cyber. Её задача — не побеждать в бенчмарках, а дёшево и быстро перемалывать объём: поиск, извлечение данных, обработка документов, перевод, классификация.

Цена и скорость

Стоимость — $0.30 за 1M входных и $2.50 за 1M выходных токенов. Для сравнения: это в пять раз дешевле по входу и втрое по выходу, чем Gemini 3.6 Flash ($1.50/$7.50). А в batch и flex-режимах цена падает ещё вдвое — до $0.15/$1.25. Скорость генерации — около 462 токенов в секунду, заметно выше среднего в классе.

Важная оговорка: при высокой скорости генерации у модели большая задержка до первого токена — около 8.9 секунды. Для интерактивного чата это ощутимо, а вот для фоновой пакетной обработки совершенно некритично. Проще говоря: она долго «раскачивается», но потом выдаёт текст очень быстро.

Качество за свои деньги

В Artificial Analysis Intelligence Index модель набирает 36 баллов — это выше среднего среди reasoning-моделей той же ценовой категории. То есть за минимальные деньги вы получаете не «обрубок», а вполне толковую модель с контекстом 1M токенов и мультимодальным входом (текст, изображения, речь, видео). Для сложных рассуждений всё же лучше брать 3.6 Flash или Pro-модели.

Доступность в России

Модель не работает в России без VPN — Google AI Studio и Gemini API заблокированы для российских IP, российские карты не принимаются. Доступ возможен через VPN с зарубежной картой либо через посредников с рублёвой оплатой. Русский язык модель понимает. Из работающих в РФ напрямую бюджетных чат-моделей — YandexGPT и GigaChat.

Часто задаваемые вопросы

Что такое Gemini 3.5 Flash-Lite?
Самая быстрая и дешёвая модель линейки Gemini 3.5, выпущенная 21 июля 2026 года. Стоит $0.30 за 1M входных и $2.50 за 1M выходных токенов, выдаёт около 462 токенов в секунду. Создана под массовые задачи: поиск, обработку документов, перевод и классификацию. Контекст — 1 млн токенов.
Насколько она дешевле Gemini 3.6 Flash?
В пять раз дешевле по входу и втрое по выходу: $0.30/$2.50 против $1.50/$7.50 за 1M токенов. А в batch и flex-режимах цена падает ещё вдвое — до $0.15/$1.25. Для больших объёмов однотипных задач разница в счёте получается кратная.
В чём подвох такой низкой цены?
Главный нюанс — задержка до первого токена около 8.9 секунды, что много для интерактивного чата: модель «раскачивается» дольше конкурентов, зато потом генерирует очень быстро. Плюс она заточена под простые массовые задачи — на сложных рассуждениях уступает 3.6 Flash и Pro-моделям.
Для каких задач подходит Flash-Lite?
Для высоконагруженных сценариев, где важны цена и пропускная способность: поиск и извлечение данных, обработка документов, перевод, классификация, лёгкие агенты, фоновая пакетная обработка. Для диалогов в реальном времени и сложной логики лучше взять Gemini 3.6 Flash.
Насколько она «умная» за такие деньги?
В Artificial Analysis Intelligence Index модель набирает 36 баллов — выше среднего среди reasoning-моделей той же ценовой категории. То есть это не урезанная заглушка, а вполне толковая модель с контекстом 1M токенов и мультимодальным входом, просто оптимизированная под цену и скорость.
Работает ли Gemini 3.5 Flash-Lite в России?
Напрямую — нет: Google AI Studio и Gemini API заблокированы для российских IP, российские карты не принимаются. Нужен VPN с зарубежной картой или посредник с рублёвой оплатой. Из бюджетных альтернатив, работающих в РФ, — YandexGPT и GigaChat.

Все эти инструменты — уже на Genova-ai

Картинки, видео, музыка, голос и ИИ-чат в одном месте. Без VPN и зарубежных карт.

Картинки
Видео
Музыка
Голос
ИИ-чат
Попробовать бесплатно