DeepSeek V4

DeepSeek V4

Две модели под свободной лицензией MIT (24 апреля 2026): V4-Pro на 1.6 трлн параметров и V4-Flash на 284 млрд. Контекст 1 млн токенов, вывод до 384K. SWE-bench Verified 80.6% — лучший результат среди моделей с открытыми весами, рейтинг Codeforces 3206. Практический вывод: младшая Flash даёт почти те же цифры втрое дешевле.

V4-Flash — $0.14 / $0.28 за 1M; V4-Pro — $0.435 / $0.87 за 1M (с 16 августа 2026 тарифы меняются)Работает в РФ
9/10📅 2026-04-24🏢 DeepSeek✓ Open Source

Рейтинг и бенчмарки

Общий рейтинг
9/10
Benchmark Score
9.1/10
Скорость
8.4/10
SWE-bench Verified
80.6% у V4-Pro — лучший результат среди моделей с открытыми весами; у V4-Flash 79.0%
Codeforces
рейтинг 3206 у V4-Pro, 3052 у V4-Flash
LiveCodeBench
93.5% (Pro) и 91.6% (Flash)
GPQA Diamond
90.1% (Pro) и 88.1% (Flash)
MMLU-Pro
87.5% (Pro) и 86.2% (Flash)
HMMT
95.2% (Pro)
BrowseComp
83.4% (Pro)
Разрыв Pro и Flash
1-2 процентных пункта при разнице в цене втрое
Экономичность
V4-Pro тратит 27% вычислений на токен и 10% KV-кеша относительно V3.2
Оговорка
все цифры заявлены разработчиком, независимое воспроизведение продолжается

Входные и выходные данные

Входные данные
текст
Выходные данные
текст

API и стоимость

Входные токены (Input)
V4-Flash — $0.14 / $0.28 за 1M; V4-Pro — $0.435 / $0.87 за 1M (с 16 августа 2026 тарифы меняются)
цена за промпт
Выходные токены (Output)
$0.87 / 1M токенов (V4-Pro), $0.28 / 1M (V4-Flash)
цена за ответ
API доступен

Способы доступа

API (api-docs.deepseek.com)веб-чат chat.deepseek.comоткрытые веса на Hugging Face и ModelScope

Сценарии использования

агентное программирование и работа с большими кодовыми базамианализ объёмных документовмассовые задачи с жёстким бюджетомлокальное развёртывание в своём контуренаучные и математические задачи

Тарифы и подписки — DeepSeek

Актуальные планы подписки провайдера. Цены могут меняться — уточняйте на странице цен

Популярный
V4-Flash (API)
$0.14 / $0.28 за 1M
  • Вход $0.14, выход $0.28 за 1M токенов
  • Кешированный вход — $0.0028 за 1M
  • 284 млрд параметров, 13 млрд активных
  • Контекст 1M, вывод до 384 000
  • Отстаёт от Pro на 1-2 пункта — оптимальный выбор
V4-Pro (API)
$0.435 / $0.87 за 1M
  • Вход $0.435, выход $0.87 за 1M токенов
  • Кешированный вход — $0.003625 за 1M
  • 1.6 трлн параметров, 49 млрд активных
  • Максимальное качество на сложных задачах
  • Режим Think Max
С 16 августа 2026
пиковые и непиковые часы
  • V4-Flash: $0.22 / $0.66 вне пика, $0.44 / $1.32 в пик
  • V4-Pro: $0.66 / $1.98 вне пика, $1.32 / $3.96 в пик
  • Пик — 01:00-04:00 и 06:00-10:00 UTC
  • Непиковый тариф вдвое ниже пикового
  • Ставки выше нынешних фиксированных
Локальный запуск
Бесплатно
  • Лицензия MIT, веса на Hugging Face и ModelScope
  • V4-Flash — 160 ГБ
  • V4-Pro — 865 ГБ, уровень дата-центра
  • Данные не покидают ваш контур
  • Работает без интернета и без VPN
Российские карты не принимаются.Genova-ai — работает в РФ без VPN

Плюсы и минусы

✓ Плюсы
Свободная лицензия MIT на обе модели — можно использовать коммерчески, дообучать и встраивать в свои продукты без отчислений и ограничений
Лучший результат среди открытых моделей на SWE-bench Verified: 80.6% — уровень топовых закрытых моделей, но с открытыми весами
Рейтинг Codeforces 3206 — один из самых высоких показателей по спортивному программированию среди всех моделей
Младшая V4-Flash отстаёт от старшей всего на 1-2 процентных пункта, а стоит втрое дешевле — для большинства задач брать имеет смысл именно её
Контекст 1 миллион токенов и вывод до 384 000 — целые кодовые базы и длинные документы за один заход
Три режима размышления: быстрый без рассуждений, Think High для сложных задач и Think Max на максимум качества
Очень дёшево: V4-Flash обходится в $0.14 за миллион входных токенов, а кешированный вход — всего $0.0028
Резко выросла экономичность: V4-Pro тратит 27% вычислений на токен и 10% KV-кеша относительно версии V3.2
Работает в России без VPN, а открытые веса позволяют развернуть модель в своём контуре
✗ Минусы
С 16 августа 2026 DeepSeek переходит на тарификацию по времени суток, и по официальной странице цен новые ставки выше нынешних: у V4-Pro выход $1.98 за 1M в непиковые часы и $3.96 в пиковые против сегодняшних $0.87
Пиковые часы — 01:00-04:00 и 06:00-10:00 UTC, то есть рабочий день в Китае. Для Москвы это утро и первая половина дня, вечерние задачи попадают в дешёвый тариф
Открытые веса не значит «запущу дома»: V4-Pro весит 865 ГБ, это уровень дата-центра. Реалистична для своего железа только V4-Flash на 160 ГБ, да и та требует серьёзной станции
Все опубликованные бенчмарки заявлены самим разработчиком, независимое воспроизведение на момент публикации ещё продолжается
На самых сложных тестах V4-Pro всё же уступает закрытым флагманам вроде GPT-5.4 и Gemini 3.1 Pro
V4-Flash заметно слабее старшей модели на задачах, требующих широких фактических знаний, и на сложных агентных сценариях
Только текст: изображения, аудио и видео модель не понимает
Российские карты не принимаются — для оплаты API нужна зарубежная карта или посредник

Подробный обзор

Что такое DeepSeek V4

DeepSeek V4 — четвёртое поколение моделей китайской компании DeepSeek, вышедшее 24 апреля 2026 года. Это не одна модель, а две, и обе под свободной лицензией MIT:

  • V4-Pro — 1.6 триллиона параметров, из которых на каждый токен работают 49 миллиардов
  • V4-Flash — 284 миллиарда параметров, 13 миллиардов активных

У обеих контекст в 1 миллион токенов и вывод до 384 000 — этого хватает, чтобы за один заход прочитать целую кодовую базу и выдать развёрнутый разбор.

Главный практический вывод: берите Flash

Самое интересное в этом релизе — не рекорды старшей модели, а то, насколько близко к ней подобралась младшая. Сравните заявленные цифры:

  • SWE-bench Verified: 80.6% у Pro против 79.0% у Flash
  • LiveCodeBench: 93.5% против 91.6%
  • GPQA Diamond: 90.1% против 88.1%
  • MMLU-Pro: 87.5% против 86.2%
  • Codeforces: 3206 против 3052

Разрыв — один-два процентных пункта, а разница в цене втрое. Для подавляющего большинства задач это делает выбор очевидным: старшая модель оправдана там, где нужны широкие фактические знания или сложные агентные сценарии, во всём остальном Flash закрывает вопрос.

Рекорд среди открытых моделей

80.6% на SWE-bench Verified — тесте на починку реального кода из репозиториев GitHub — это лучший результат среди всех моделей с открытыми весами. Рейтинг Codeforces 3206 ставит V4-Pro в число сильнейших моделей по спортивному программированию вообще.

Отдельно стоит отметить инженерную работу: V4-Pro тратит 27% вычислений на токен и всего 10% KV-кеша относительно предыдущей версии V3.2. Именно это позволило держать цену низкой при выросшем размере модели.

Обязательная оговорка: все эти цифры заявлены самой DeepSeek, независимое воспроизведение на момент публикации ещё продолжается. На самых трудных задачах модель по-прежнему уступает закрытым флагманам вроде GPT-5.4 и Gemini 3.1 Pro.

Важно: с 16 августа 2026 цены меняются

Сейчас тарифы фиксированные и очень низкие: V4-Flash — $0.14 за миллион входных токенов и $0.28 за выходные, V4-Pro — $0.435 и $0.87. Кешированный вход стоит копейки: $0.0028 и $0.003625 соответственно.

С 16 августа 2026 года DeepSeek переходит на тарификацию по времени суток. По официальной странице цен ставки выглядят так:

  • V4-Flash: $0.22 / $0.66 вне пика и $0.44 / $1.32 в пиковые часы
  • V4-Pro: $0.66 / $1.98 вне пика и $1.32 / $3.96 в пик

Обратите внимание: даже непиковая ставка выше сегодняшней фиксированной — у V4-Pro выход дорожает с $0.87 до $1.98. Пиковыми считаются 01:00-04:00 и 06:00-10:00 UTC, то есть рабочий день в Китае; всё остальное время идёт по сниженному тарифу. Для Москвы это означает, что дорогое окно приходится на утро и первую половину дня, а вечерние и ночные задачи попадают в дешёвый тариф — если работу можно ставить в очередь, это заметно снижает счёт.

Открытые веса — но не для домашнего компьютера

Лицензия MIT здесь настоящая, без оговорок: можно использовать коммерчески, дообучать, встраивать в свои продукты. Но с размерами надо считаться. V4-Pro весит 865 ГБ — это уровень дата-центра, а не рабочей станции. V4-Flash на 160 ГБ уже реалистичнее, хотя и ей нужна серьёзная машина.

Тем не менее сама возможность важна: для медицинских, юридических и корпоративных данных развёртывание в своём контуре часто оказывается единственным приемлемым вариантом. Если такие требования есть, но железа под V4 нет, посмотрите GPT-OSS 120B — он скромнее по качеству, зато помещается на одну видеокарту.

Доступность в России

Веб-чат и API DeepSeek открываются из России без VPN — этим компания выгодно отличается от OpenAI и Anthropic. Барьер один: российские карты для оплаты API не принимаются, нужна зарубежная карта или посредник. Веб-версия при этом доступна бесплатно. И, разумеется, открытые веса можно скачать и запустить у себя без каких-либо ограничений.

Часто задаваемые вопросы

Что такое DeepSeek V4?
Четвёртое поколение моделей DeepSeek, вышедшее 24 апреля 2026 года. Это две модели под свободной лицензией MIT: V4-Pro на 1.6 триллиона параметров (49 миллиардов активных) и V4-Flash на 284 миллиарда (13 миллиардов активных). У обеих контекст 1 миллион токенов и вывод до 384 000.
V4-Pro или V4-Flash — что выбрать?
Для большинства задач — Flash. Она отстаёт от старшей модели всего на один-два процентных пункта по бенчмаркам (SWE-bench Verified 79.0% против 80.6%), а стоит втрое дешевле. Pro оправдана там, где нужны широкие фактические знания или сложные агентные сценарии — на них разрыв заметнее.
Сколько стоит DeepSeek V4?
Сейчас V4-Flash обходится в $0.14 за миллион входных токенов и $0.28 за выходные, V4-Pro — $0.435 и $0.87. Кешированный вход стоит копейки: $0.0028 и $0.003625. Но с 16 августа 2026 DeepSeek переходит на тарификацию по времени суток, и новые ставки выше: у V4-Pro выход подорожает до $1.98 вне пика и $3.96 в пиковые часы.
Что за пиковые и непиковые часы у DeepSeek?
С 16 августа 2026 цена зависит от времени суток: непиковый тариф вдвое ниже пикового. Пиком считаются 01:00-04:00 и 06:00-10:00 UTC — рабочий день в Китае. Для Москвы дорогое окно приходится на утро и первую половину дня, а вечерние и ночные задачи попадают в дешёвый тариф. Если работу можно поставить в очередь, счёт снижается вдвое.
Действительно ли у DeepSeek V4 открытые веса?
Да, обе модели опубликованы под лицензией MIT — самой свободной из распространённых. Коммерческое использование, дообучение и встраивание в свои продукты разрешены без отчислений. Веса лежат на Hugging Face и ModelScope.
Можно ли запустить DeepSeek V4 на своём компьютере?
Дома — практически нет. V4-Pro весит 865 ГБ, это уровень дата-центра. V4-Flash на 160 ГБ реалистичнее, но и ей нужна серьёзная рабочая станция. Если важен именно локальный запуск на доступном железе, посмотрите GPT-OSS 120B — он скромнее по качеству, зато помещается на одну видеокарту 80 ГБ.
Насколько DeepSeek V4 хороша в программировании?
По заявленным цифрам — очень: 80.6% на SWE-bench Verified у V4-Pro, лучший результат среди моделей с открытыми весами, и рейтинг Codeforces 3206, один из самых высоких среди всех моделей вообще. LiveCodeBench — 93.5%. Важно, что бенчмарки заявлены самим разработчиком, а независимое воспроизведение ещё продолжается.
Работает ли DeepSeek V4 в России?
Да, веб-чат и API открываются без VPN — этим DeepSeek выгодно отличается от OpenAI и Anthropic. Единственный барьер: российские карты для оплаты API не принимаются, нужна зарубежная карта или посредник. Веб-версия доступна бесплатно, а открытые веса можно скачать без ограничений.
Что такое режимы Think High и Think Max?
Три уровня размышления модели: быстрый режим без рассуждений для рутинных задач, Think High для сложных задач и Think Max для максимального качества на самых трудных. Чем глубже режим, тем больше токенов уходит на рассуждения и тем дороже обходится запрос — но и качество ответа выше.

Все эти инструменты — уже на Genova-ai

Картинки, видео, музыка, голос и ИИ-чат в одном месте. Без VPN и зарубежных карт.

Картинки
Видео
Музыка
Голос
ИИ-чат
Попробовать бесплатно