Gemini 3.5 Flash-Lite
Самая быстрая и дешёвая модель линейки Gemini 3.5 (21 июля 2026): $0.30/$2.50 за 1M токенов — впятеро дешевле по входу, чем Gemini 3.6 Flash. Выдаёт около 460 токенов в секунду, контекст 1M, вход текст/изображения/речь/видео. Создана под массовые задачи: поиск, обработку документов и перевод.
Рейтинг и бенчмарки
Входные и выходные данные
API и стоимость
Способы доступа
Сценарии использования
Тарифы и подписки — Google DeepMind
Актуальные планы подписки провайдера. Цены могут меняться — уточняйте на странице цен
- Вход $0.30, выход $2.50 за 1M токенов
- Контекст 1M
- Мультимодальный вход
- Google AI Studio и Vertex AI
- Вдвое дешевле стандартного тарифа
- Для офлайн и фоновой обработки
- Максимальная экономия на объёмах
- Тестирование в Google AI Studio
- Дневные лимиты
- Без оплаты на старте
Плюсы и минусы
Подробный обзор
Что такое Gemini 3.5 Flash-Lite
Gemini 3.5 Flash-Lite — самая быстрая и дешёвая модель линейки Gemini 3.5, выпущенная 21 июля 2026 года вместе с Gemini 3.6 Flash и специализированной 3.5 Flash Cyber. Её задача — не побеждать в бенчмарках, а дёшево и быстро перемалывать объём: поиск, извлечение данных, обработка документов, перевод, классификация.
Цена и скорость
Стоимость — $0.30 за 1M входных и $2.50 за 1M выходных токенов. Для сравнения: это в пять раз дешевле по входу и втрое по выходу, чем Gemini 3.6 Flash ($1.50/$7.50). А в batch и flex-режимах цена падает ещё вдвое — до $0.15/$1.25. Скорость генерации — около 462 токенов в секунду, заметно выше среднего в классе.
Важная оговорка: при высокой скорости генерации у модели большая задержка до первого токена — около 8.9 секунды. Для интерактивного чата это ощутимо, а вот для фоновой пакетной обработки совершенно некритично. Проще говоря: она долго «раскачивается», но потом выдаёт текст очень быстро.
Качество за свои деньги
В Artificial Analysis Intelligence Index модель набирает 36 баллов — это выше среднего среди reasoning-моделей той же ценовой категории. То есть за минимальные деньги вы получаете не «обрубок», а вполне толковую модель с контекстом 1M токенов и мультимодальным входом (текст, изображения, речь, видео). Для сложных рассуждений всё же лучше брать 3.6 Flash или Pro-модели.
Доступность в России
Модель не работает в России без VPN — Google AI Studio и Gemini API заблокированы для российских IP, российские карты не принимаются. Доступ возможен через VPN с зарубежной картой либо через посредников с рублёвой оплатой. Русский язык модель понимает. Из работающих в РФ напрямую бюджетных чат-моделей — YandexGPT и GigaChat.