DeepSeek V4.1 Flash
DeepSeek V4.1 Flash - открытая модель DeepSeek от 10 сентября 2026 года на новой архитектуре энкодер-декодер, со встроенным зрением. По тестам DeepSeek обходит прежний флагман V4-Pro: DeepSWE 74.2% против 74.0% у Claude Opus 5. Контекст 1M, вывод до 384K, веса под MIT. API от $0.15 за 1M входных токенов вне пиковых часов.
Рейтинг и бенчмарки
Входные и выходные данные
API и стоимость
Способы доступа
Сценарии использования
Тарифы и подписки - DeepSeek
Актуальные планы подписки провайдера. Цены могут меняться - уточняйте на странице цен
- Кеш $0.003 за 1M
- Вечер и ночь по Москве, выходные
- Идентификатор deepseek-flash
- 01:00-04:00 и 06:00-10:00 UTC по будням
- Кеш $0.006 за 1M
- До 2500 одновременных запросов
- Лицензия MIT
- Hugging Face: deepseek-ai/DeepSeek-V4.1-Flash
- Нужен серверный кластер
Плюсы и минусы
Подробный обзор
Что такое DeepSeek V4.1 Flash
DeepSeek V4.1 Flash - открытая модель китайской DeepSeek, выпущенная 10 сентября 2026 года. Она заменила V4-Flash и V4-Flash-Vision-Exp из семейства DeepSeek V4. По словам DeepSeek, новые методы предобучения и масштабное обучение с подкреплением дали результаты выше прежнего флагмана V4-Pro.
Поэтому с 14 сентября все запросы к deepseek-v4-pro в API тоже обслуживает V4.1 Flash по ее тарифу. Так будет, пока не выйдет старшая V4.1-Pro. Старые имена deepseek-v4-flash и deepseek-v4-flash-vision-exp временно перенаправляются на новую модель, основное имя - deepseek-flash.
Новая архитектура
Главное изменение - устройство модели. Вместо привычной схемы DeepSeek перешла на причинный энкодер-декодер: 20 слоев энкодера и 20 слоев декодера. Внутри по-прежнему смесь экспертов: 384 эксперта, на каждый токен работают 6 из них плюс один общий. Основа модели - 552 млрд параметров, вместе со всеми модулями - 763 млрд. Активных параметров 8 млрд при чтении запроса и 16 млрд при генерации ответа.
Практический смысл - экономия на длинном контексте. KV-кеш занимает в 4 раза меньше памяти видеокарты и в 8 раз меньше места на SSD, чем у прошлого поколения. Зрение встроено прямо в модель через собственный энкодер изображений DeepSeek-ViT. Глубину рассуждений можно задать числом от 1 до 100.
Бенчмарки
- DeepSWE v1.1: 74.2 против 74.0 у Claude Opus 5
- Terminal-Bench 2.1: 90.6 против 89.1 у Claude Opus 5
- Codeforces: рейтинг 3471 против 3348 у GPT-5.6 Sol
- HumanEval: 79.4 против 69.5 у V4-Flash
Цифры сняты на максимальной глубине рассуждений и опубликованы самой DeepSeek. Сравнение идет с Claude Opus 5 и GPT-5.6 Sol, а не с вышедшими позже Claude Opus 5.5 и GPT-6.1 Sol. Для ориентира: на том же DeepSWE v1.1 у GPT-6.1 Sol 75.2%, у Grok 4.7 71.0%.
Сколько стоит
DeepSeek берет плату по времени суток. Пиковые часы - 01:00-04:00 и 06:00-10:00 UTC по будням, кроме китайских праздников. Для Москвы это 04:00-07:00 и 09:00-13:00.
- Вне пика: $0.15 за 1M входных токенов, $0.60 за 1M выходных, кеш $0.003
- В пик: $0.30, $1.20 и $0.006
Это дороже прежней V4-Flash с ее $0.14 и $0.28, но заметно дешевле V4-Pro. Если вы сидели на deepseek-v4-pro, счет снизится сам: с 14 сентября такие запросы считаются по цене V4.1 Flash.
Технические характеристики
Контекст 1 млн токенов, вывод до 384 тысяч. На входе текст и изображения, на выходе текст. Поддерживаются JSON-вывод, вызов инструментов и режим размышлений. Лимит - до 2500 одновременных запросов. Веса лежат на Hugging Face под лицензией MIT. Для запуска DeepSeek советует температуру 1.0, top-p 0.95-1.0 и лимит вывода от 256 тысяч токенов.
Доступность в России
API DeepSeek работает из России без VPN. Оплатить его российской картой нельзя: нужна зарубежная карта или посредник. Открытые веса можно развернуть в своем контуре, но для модели такого размера нужен серверный кластер. Если нужна российская модель с открытыми весами, смотрите GigaChat 3.5 Ultra.