DeepSeek V4
Две модели под свободной лицензией MIT (24 апреля 2026): V4-Pro на 1.6 трлн параметров и V4-Flash на 284 млрд. Контекст 1 млн токенов, вывод до 384K. SWE-bench Verified 80.6% — лучший результат среди моделей с открытыми весами, рейтинг Codeforces 3206. Практический вывод: младшая Flash даёт почти те же цифры втрое дешевле.
Рейтинг и бенчмарки
Входные и выходные данные
API и стоимость
Способы доступа
Сценарии использования
Тарифы и подписки — DeepSeek
Актуальные планы подписки провайдера. Цены могут меняться — уточняйте на странице цен
- Вход $0.14, выход $0.28 за 1M токенов
- Кешированный вход — $0.0028 за 1M
- 284 млрд параметров, 13 млрд активных
- Контекст 1M, вывод до 384 000
- Отстаёт от Pro на 1-2 пункта — оптимальный выбор
- Вход $0.435, выход $0.87 за 1M токенов
- Кешированный вход — $0.003625 за 1M
- 1.6 трлн параметров, 49 млрд активных
- Максимальное качество на сложных задачах
- Режим Think Max
- V4-Flash: $0.22 / $0.66 вне пика, $0.44 / $1.32 в пик
- V4-Pro: $0.66 / $1.98 вне пика, $1.32 / $3.96 в пик
- Пик — 01:00-04:00 и 06:00-10:00 UTC
- Непиковый тариф вдвое ниже пикового
- Ставки выше нынешних фиксированных
- Лицензия MIT, веса на Hugging Face и ModelScope
- V4-Flash — 160 ГБ
- V4-Pro — 865 ГБ, уровень дата-центра
- Данные не покидают ваш контур
- Работает без интернета и без VPN
Плюсы и минусы
Подробный обзор
Что такое DeepSeek V4
DeepSeek V4 — четвёртое поколение моделей китайской компании DeepSeek, вышедшее 24 апреля 2026 года. Это не одна модель, а две, и обе под свободной лицензией MIT:
- V4-Pro — 1.6 триллиона параметров, из которых на каждый токен работают 49 миллиардов
- V4-Flash — 284 миллиарда параметров, 13 миллиардов активных
У обеих контекст в 1 миллион токенов и вывод до 384 000 — этого хватает, чтобы за один заход прочитать целую кодовую базу и выдать развёрнутый разбор.
Главный практический вывод: берите Flash
Самое интересное в этом релизе — не рекорды старшей модели, а то, насколько близко к ней подобралась младшая. Сравните заявленные цифры:
- SWE-bench Verified: 80.6% у Pro против 79.0% у Flash
- LiveCodeBench: 93.5% против 91.6%
- GPQA Diamond: 90.1% против 88.1%
- MMLU-Pro: 87.5% против 86.2%
- Codeforces: 3206 против 3052
Разрыв — один-два процентных пункта, а разница в цене втрое. Для подавляющего большинства задач это делает выбор очевидным: старшая модель оправдана там, где нужны широкие фактические знания или сложные агентные сценарии, во всём остальном Flash закрывает вопрос.
Рекорд среди открытых моделей
80.6% на SWE-bench Verified — тесте на починку реального кода из репозиториев GitHub — это лучший результат среди всех моделей с открытыми весами. Рейтинг Codeforces 3206 ставит V4-Pro в число сильнейших моделей по спортивному программированию вообще.
Отдельно стоит отметить инженерную работу: V4-Pro тратит 27% вычислений на токен и всего 10% KV-кеша относительно предыдущей версии V3.2. Именно это позволило держать цену низкой при выросшем размере модели.
Обязательная оговорка: все эти цифры заявлены самой DeepSeek, независимое воспроизведение на момент публикации ещё продолжается. На самых трудных задачах модель по-прежнему уступает закрытым флагманам вроде GPT-5.4 и Gemini 3.1 Pro.
Важно: с 16 августа 2026 цены меняются
Сейчас тарифы фиксированные и очень низкие: V4-Flash — $0.14 за миллион входных токенов и $0.28 за выходные, V4-Pro — $0.435 и $0.87. Кешированный вход стоит копейки: $0.0028 и $0.003625 соответственно.
С 16 августа 2026 года DeepSeek переходит на тарификацию по времени суток. По официальной странице цен ставки выглядят так:
- V4-Flash: $0.22 / $0.66 вне пика и $0.44 / $1.32 в пиковые часы
- V4-Pro: $0.66 / $1.98 вне пика и $1.32 / $3.96 в пик
Обратите внимание: даже непиковая ставка выше сегодняшней фиксированной — у V4-Pro выход дорожает с $0.87 до $1.98. Пиковыми считаются 01:00-04:00 и 06:00-10:00 UTC, то есть рабочий день в Китае; всё остальное время идёт по сниженному тарифу. Для Москвы это означает, что дорогое окно приходится на утро и первую половину дня, а вечерние и ночные задачи попадают в дешёвый тариф — если работу можно ставить в очередь, это заметно снижает счёт.
Открытые веса — но не для домашнего компьютера
Лицензия MIT здесь настоящая, без оговорок: можно использовать коммерчески, дообучать, встраивать в свои продукты. Но с размерами надо считаться. V4-Pro весит 865 ГБ — это уровень дата-центра, а не рабочей станции. V4-Flash на 160 ГБ уже реалистичнее, хотя и ей нужна серьёзная машина.
Тем не менее сама возможность важна: для медицинских, юридических и корпоративных данных развёртывание в своём контуре часто оказывается единственным приемлемым вариантом. Если такие требования есть, но железа под V4 нет, посмотрите GPT-OSS 120B — он скромнее по качеству, зато помещается на одну видеокарту.
Доступность в России
Веб-чат и API DeepSeek открываются из России без VPN — этим компания выгодно отличается от OpenAI и Anthropic. Барьер один: российские карты для оплаты API не принимаются, нужна зарубежная карта или посредник. Веб-версия при этом доступна бесплатно. И, разумеется, открытые веса можно скачать и запустить у себя без каких-либо ограничений.