DeepSeek V4.1 Flash

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash - открытая модель DeepSeek от 10 сентября 2026 года на новой архитектуре энкодер-декодер, со встроенным зрением. По тестам DeepSeek обходит прежний флагман V4-Pro: DeepSWE 74.2% против 74.0% у Claude Opus 5. Контекст 1M, вывод до 384K, веса под MIT. API от $0.15 за 1M входных токенов вне пиковых часов.

API $0.30 / $1.20 за 1M в пиковые часы, $0.15 / $0.60 в остальное время; открытые веса MITРаботает в РФ
⭐ 9.2/10📅 2026-09-10🏢 DeepSeek✓ Open Source

Рейтинг и бенчмарки

Общий рейтинг
9.2/10
Benchmark Score
9.1/10
Скорость
9/10
Релиз
10 сентября 2026, замена V4-Flash; запросы к V4-Pro с 14 сентября тоже обслуживает V4.1 Flash
DeepSWE v1.1
74.2 против 74.0 у Claude Opus 5
Terminal-Bench 2.1
90.6 против 89.1 у Claude Opus 5
Codeforces
3471 против 3348 у GPT-5.6 Sol
HumanEval
79.4 против 69.5 у DeepSeek V4-Flash
Архитектура
энкодер-декодер, 20 + 20 слоев, MoE: 384 эксперта, 6 активных плюс 1 общий
KV-кеш
в 4 раза меньше памяти видеокарты и в 8 раз меньше места на SSD, чем у прошлого поколения
Цена
$0.30 / $1.20 за 1M в пик, вдвое дешевле в остальное время
Контекст
1M токенов, вывод до 384K

Входные и выходные данные

Входные данные
текстизображение
Выходные данные
текст

API и стоимость

Входные токены (Input)
API $0.30 / $1.20 за 1M в пиковые часы, $0.15 / $0.60 в остальное время; открытые веса MIT
цена за промпт
Выходные токены (Output)
$1.20 / 1M в пиковые часы, $0.60 в остальное время; ввод $0.30 / $0.15, кеш $0.006 / $0.003
цена за ответ
✓API доступен

Способы доступа

API (deepseek-flash)открытые веса на Hugging Face

Сценарии использования

агентное программированиезадачи в терминалеспортивное программированиеразбор документов со скриншотами и схемамимассовые задачи с жестким бюджетомразвертывание в своем контуре

Тарифы и подписки - DeepSeek

Актуальные планы подписки провайдера. Цены могут меняться - уточняйте на странице цен

Популярный
API, вне пика
$0.15 / $0.60 за 1M
  • Кеш $0.003 за 1M
  • Вечер и ночь по Москве, выходные
  • Идентификатор deepseek-flash
API, пиковые часы
$0.30 / $1.20 за 1M
  • 01:00-04:00 и 06:00-10:00 UTC по будням
  • Кеш $0.006 за 1M
  • До 2500 одновременных запросов
Открытые веса
Бесплатно
  • Лицензия MIT
  • Hugging Face: deepseek-ai/DeepSeek-V4.1-Flash
  • Нужен серверный кластер
Российские карты не принимаются.Genova-ai - работает в РФ без VPN

Плюсы и минусы

✓ Плюсы
По тестам DeepSeek на уровне закрытых флагманов: DeepSWE v1.1 74.2 против 74.0 у Claude Opus 5, Terminal-Bench 2.1 90.6 против 89.1
Рейтинг Codeforces 3471 - выше, чем у GPT-5.6 Sol (3348)
Открытые веса под MIT: можно использовать коммерчески, дообучать и развернуть у себя
Встроенное зрение: модель понимает картинки, у V4-Flash этого не было
Дешево: $0.15 за 1M входных и $0.60 за 1M выходных токенов вне пиковых часов, кеш от $0.003
Контекст 1 миллион токенов и вывод до 384 тысяч за ответ
Глубину рассуждений можно задать числом от 1 до 100 и точно настроить баланс цены и качества
Экономнее на длинном контексте: KV-кеш занимает в 4 раза меньше памяти видеокарты, чем у прошлого поколения
Работает в России без VPN
✗ Минусы
Дороже V4-Flash: у той выход стоил $0.28 за 1M, у V4.1 Flash $0.60 вне пика и $1.20 в пик
Пиковые часы 01:00-04:00 и 06:00-10:00 UTC по будням - для Москвы это утро и первая половина дня, когда цена вдвое выше
Все бенчмарки опубликовал сам разработчик, а сравнивает он себя с Claude Opus 5, а не с более новыми Opus 5.5 и Sonnet 5.5
Открытые веса не значит "запущу дома": модель на 763 млрд параметров требует серверного железа
Старшую V4.1-Pro пока только обещают: до ее выхода запросы к V4-Pro отправляются на V4.1 Flash, и на сложнейших задачах это может быть шаг назад
Российские карты не принимаются, для оплаты API нужна зарубежная карта или посредник
На выходе только текст

Подробный обзор

Что такое DeepSeek V4.1 Flash

DeepSeek V4.1 Flash - открытая модель китайской DeepSeek, выпущенная 10 сентября 2026 года. Она заменила V4-Flash и V4-Flash-Vision-Exp из семейства DeepSeek V4. По словам DeepSeek, новые методы предобучения и масштабное обучение с подкреплением дали результаты выше прежнего флагмана V4-Pro.

Поэтому с 14 сентября все запросы к deepseek-v4-pro в API тоже обслуживает V4.1 Flash по ее тарифу. Так будет, пока не выйдет старшая V4.1-Pro. Старые имена deepseek-v4-flash и deepseek-v4-flash-vision-exp временно перенаправляются на новую модель, основное имя - deepseek-flash.

Новая архитектура

Главное изменение - устройство модели. Вместо привычной схемы DeepSeek перешла на причинный энкодер-декодер: 20 слоев энкодера и 20 слоев декодера. Внутри по-прежнему смесь экспертов: 384 эксперта, на каждый токен работают 6 из них плюс один общий. Основа модели - 552 млрд параметров, вместе со всеми модулями - 763 млрд. Активных параметров 8 млрд при чтении запроса и 16 млрд при генерации ответа.

Практический смысл - экономия на длинном контексте. KV-кеш занимает в 4 раза меньше памяти видеокарты и в 8 раз меньше места на SSD, чем у прошлого поколения. Зрение встроено прямо в модель через собственный энкодер изображений DeepSeek-ViT. Глубину рассуждений можно задать числом от 1 до 100.

Бенчмарки

  • DeepSWE v1.1: 74.2 против 74.0 у Claude Opus 5
  • Terminal-Bench 2.1: 90.6 против 89.1 у Claude Opus 5
  • Codeforces: рейтинг 3471 против 3348 у GPT-5.6 Sol
  • HumanEval: 79.4 против 69.5 у V4-Flash

Цифры сняты на максимальной глубине рассуждений и опубликованы самой DeepSeek. Сравнение идет с Claude Opus 5 и GPT-5.6 Sol, а не с вышедшими позже Claude Opus 5.5 и GPT-6.1 Sol. Для ориентира: на том же DeepSWE v1.1 у GPT-6.1 Sol 75.2%, у Grok 4.7 71.0%.

Сколько стоит

DeepSeek берет плату по времени суток. Пиковые часы - 01:00-04:00 и 06:00-10:00 UTC по будням, кроме китайских праздников. Для Москвы это 04:00-07:00 и 09:00-13:00.

  • Вне пика: $0.15 за 1M входных токенов, $0.60 за 1M выходных, кеш $0.003
  • В пик: $0.30, $1.20 и $0.006

Это дороже прежней V4-Flash с ее $0.14 и $0.28, но заметно дешевле V4-Pro. Если вы сидели на deepseek-v4-pro, счет снизится сам: с 14 сентября такие запросы считаются по цене V4.1 Flash.

Технические характеристики

Контекст 1 млн токенов, вывод до 384 тысяч. На входе текст и изображения, на выходе текст. Поддерживаются JSON-вывод, вызов инструментов и режим размышлений. Лимит - до 2500 одновременных запросов. Веса лежат на Hugging Face под лицензией MIT. Для запуска DeepSeek советует температуру 1.0, top-p 0.95-1.0 и лимит вывода от 256 тысяч токенов.

Доступность в России

API DeepSeek работает из России без VPN. Оплатить его российской картой нельзя: нужна зарубежная карта или посредник. Открытые веса можно развернуть в своем контуре, но для модели такого размера нужен серверный кластер. Если нужна российская модель с открытыми весами, смотрите GigaChat 3.5 Ultra.

Часто задаваемые вопросы

Что такое DeepSeek V4.1 Flash и когда она вышла?
Открытая модель DeepSeek, выпущенная 10 сентября 2026 года. Она заменила V4-Flash, получила новую архитектуру энкодер-декодер и встроенное зрение. По тестам DeepSeek обходит прежний флагман V4-Pro, поэтому с 14 сентября запросы к V4-Pro в API тоже обслуживает V4.1 Flash.
Сколько стоит DeepSeek V4.1 Flash?
В пиковые часы (01:00-04:00 и 06:00-10:00 UTC по будням) $0.30 за 1M входных токенов и $1.20 за 1M выходных, кеш $0.006. В остальное время вдвое дешевле: $0.15, $0.60 и $0.003. Открытые веса бесплатны.
Чем V4.1 Flash отличается от DeepSeek V4?
Новая архитектура: причинный энкодер-декодер вместо прежней схемы, KV-кеш в 4 раза экономнее. Появилось зрение. По тестам она сильнее и V4-Flash, и V4-Pro: HumanEval 79.4 против 69.5 у V4-Flash. Но выход стоит дороже, чем у V4-Flash: $0.60-1.20 против $0.28 за миллион токенов.
Насколько DeepSeek V4.1 Flash сильна в программировании?
По данным DeepSeek: DeepSWE v1.1 74.2 против 74.0 у Claude Opus 5, Terminal-Bench 2.1 90.6 против 89.1, рейтинг Codeforces 3471 против 3348 у GPT-5.6 Sol. Для сравнения, у вышедшей позже GPT-6.1 Sol на DeepSWE 75.2%.
Можно ли запустить DeepSeek V4.1 Flash у себя?
Да, веса открыты на Hugging Face под лицензией MIT. Но модель весит 763 млрд параметров со всеми модулями, так что ей нужен серверный кластер, а не домашний компьютер.
Понимает ли V4.1 Flash картинки?
Да. Зрение встроено в модель через энкодер изображений DeepSeek-ViT. Отвечает модель текстом.
Работает ли DeepSeek V4.1 Flash в России?
Да, API DeepSeek доступен из России без VPN. Российские карты для оплаты не принимаются, нужна зарубежная карта или посредник. Веса можно развернуть в своем контуре.

Все эти инструменты - уже на Genova-ai

Картинки, видео, музыка, голос и ИИ-чат в одном месте. Без VPN и зарубежных карт.

Картинки
Видео
Музыка
Голос
ИИ-чат
Попробовать бесплатно