Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite

Самая быстрая и дешевая модель линейки Gemini 3.5 (21 июля 2026): $0.30/$2.50 за 1M токенов - впятеро дешевле по входу, чем Gemini 3.6 Flash. Выдает около 460 токенов в секунду, контекст 1M, вход текст/изображения/речь/видео. Создана под массовые задачи: поиск, обработку документов и перевод.

API $0.30 / $2.50 за 1M (batch и flex - вдвое дешевле)Нужен VPNРусский язык
⭐ 7.9/10📅 2026-07-21🏢 Google DeepMindProprietary

Рейтинг и бенчмарки

Общий рейтинг
7.9/10
Benchmark Score
7.6/10
Скорость
9.5/10
Цена
$0.30 / $2.50 за 1M - в 5 раз дешевле по входу, чем 3.6 Flash
Скорость
~462 токена/сек - заметно выше среднего в классе
Artificial Analysis Intelligence Index
36 - выше среднего среди reasoning-моделей своей ценовой категории
Задержка первого токена
~8.9 сек - высокая для класса
Контекст
1M токенов

Входные и выходные данные

Входные данные
текстизображениеаудиовидео
Выходные данные
текст

API и стоимость

Входные токены (Input)
API $0.30 / $2.50 за 1M (batch и flex - вдвое дешевле)
цена за промпт
Выходные токены (Output)
$2.50 / 1M токенов
цена за ответ
✓API доступен

Способы доступа

API (Gemini APIGoogle AI Studio)Vertex AI

Сценарии использования

высоконагруженные задачипоиск и извлечение данныхобработка документовпереводклассификациялегкие агенты

Тарифы и подписки - Google DeepMind

Актуальные планы подписки провайдера. Цены могут меняться - уточняйте на странице цен

Популярный
API (стандарт)
$0.30 / $2.50 за 1M
  • Вход $0.30, выход $2.50 за 1M токенов
  • Контекст 1M
  • Мультимодальный вход
  • Google AI Studio и Vertex AI
API (batch / flex)
$0.15 / $1.25 за 1M
  • Вдвое дешевле стандартного тарифа
  • Для офлайн и фоновой обработки
  • Максимальная экономия на объемах
Бесплатный уровень
Бесплатно
  • Тестирование в Google AI Studio
  • Дневные лимиты
  • Без оплаты на старте
Российские карты не принимаются.Genova-ai - работает в РФ без VPN

Плюсы и минусы

✓ Плюсы
Самая дешевая в линейке 3.5: $0.30/$2.50 за 1M - впятеро дешевле по входу и втрое по выходу, чем Gemini 3.6 Flash
Очень высокая скорость генерации - около 462 токенов в секунду, заметно выше среднего в своем классе
Batch и flex-режимы удешевляют еще вдвое ($0.15/$1.25) - выгодно для офлайн-обработки больших объемов
Умный для своей цены: 36 в Artificial Analysis Intelligence Index - выше среднего среди reasoning-моделей той же ценовой категории
Контекст 1M токенов и мультимодальный вход (текст, изображения, речь, видео) даже в самом бюджетном тире
Идеальна под массовые сценарии: поиск, извлечение и обработка документов, перевод, классификация
✗ Минусы
Высокая задержка до первого токена - около 8.9 секунды, что много для интерактивных чатов; лучше для фоновой обработки
Не работает в России без VPN - сервисы Google заблокированы для российских IP
Российские карты не принимаются ни для API, ни для подписок
Заточена под простые массовые задачи: на сложных рассуждениях уступает 3.6 Flash и Pro-моделям
Проприетарная и облачная - без локального запуска
Вышла в один день с 3.6 Flash и 3.5 Flash Cyber - в линейке Gemini легко запутаться в версиях

Подробный обзор

Что такое Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite - самая быстрая и дешевая модель линейки Gemini 3.5, выпущенная 21 июля 2026 года вместе с Gemini 3.6 Flash и специализированной 3.5 Flash Cyber. Ее задача - не побеждать в бенчмарках, а дешево и быстро перемалывать объем: поиск, извлечение данных, обработка документов, перевод, классификация.

Цена и скорость

Стоимость - $0.30 за 1M входных и $2.50 за 1M выходных токенов. Для сравнения: это в пять раз дешевле по входу и втрое по выходу, чем Gemini 3.6 Flash ($1.50/$7.50). А в batch и flex-режимах цена падает еще вдвое - до $0.15/$1.25. Скорость генерации - около 462 токенов в секунду, заметно выше среднего в классе.

Важная оговорка: при высокой скорости генерации у модели большая задержка до первого токена - около 8.9 секунды. Для интерактивного чата это ощутимо, а вот для фоновой пакетной обработки совершенно некритично. Проще говоря: она долго "раскачивается", но потом выдает текст очень быстро.

Качество за свои деньги

В Artificial Analysis Intelligence Index модель набирает 36 баллов - это выше среднего среди reasoning-моделей той же ценовой категории. То есть за минимальные деньги вы получаете не "обрубок", а вполне толковую модель с контекстом 1M токенов и мультимодальным входом (текст, изображения, речь, видео). Для сложных рассуждений все же лучше брать 3.6 Flash или Pro-модели.

Доступность в России

Модель не работает в России без VPN - Google AI Studio и Gemini API заблокированы для российских IP, российские карты не принимаются. Доступ возможен через VPN с зарубежной картой либо через посредников с рублевой оплатой. Русский язык модель понимает. Из работающих в РФ напрямую бюджетных чат-моделей - YandexGPT и GigaChat.

Часто задаваемые вопросы

Что такое Gemini 3.5 Flash-Lite?
Самая быстрая и дешевая модель линейки Gemini 3.5, выпущенная 21 июля 2026 года. Стоит $0.30 за 1M входных и $2.50 за 1M выходных токенов, выдает около 462 токенов в секунду. Создана под массовые задачи: поиск, обработку документов, перевод и классификацию. Контекст - 1 млн токенов.
Насколько она дешевле Gemini 3.6 Flash?
В пять раз дешевле по входу и втрое по выходу: $0.30/$2.50 против $1.50/$7.50 за 1M токенов. А в batch и flex-режимах цена падает еще вдвое - до $0.15/$1.25. Для больших объемов однотипных задач разница в счете получается кратная.
В чем подвох такой низкой цены?
Главный нюанс - задержка до первого токена около 8.9 секунды, что много для интерактивного чата: модель "раскачивается" дольше конкурентов, зато потом генерирует очень быстро. Плюс она заточена под простые массовые задачи - на сложных рассуждениях уступает 3.6 Flash и Pro-моделям.
Для каких задач подходит Flash-Lite?
Для высоконагруженных сценариев, где важны цена и пропускная способность: поиск и извлечение данных, обработка документов, перевод, классификация, легкие агенты, фоновая пакетная обработка. Для диалогов в реальном времени и сложной логики лучше взять Gemini 3.6 Flash.
Насколько она "умная" за такие деньги?
В Artificial Analysis Intelligence Index модель набирает 36 баллов - выше среднего среди reasoning-моделей той же ценовой категории. То есть это не урезанная заглушка, а вполне толковая модель с контекстом 1M токенов и мультимодальным входом, просто оптимизированная под цену и скорость.
Работает ли Gemini 3.5 Flash-Lite в России?
Напрямую - нет: Google AI Studio и Gemini API заблокированы для российских IP, российские карты не принимаются. Нужен VPN с зарубежной картой или посредник с рублевой оплатой. Из бюджетных альтернатив, работающих в РФ, - YandexGPT и GigaChat.

Все эти инструменты - уже на Genova-ai

Картинки, видео, музыка, голос и ИИ-чат в одном месте. Без VPN и зарубежных карт.

Картинки
Видео
Музыка
Голос
ИИ-чат
Попробовать бесплатно