DeepSeek R1-0528
Обновлённая reasoning-модель DeepSeek (28 мая 2025): MoE на 671B с 37B активных, глубокие пошаговые рассуждения. Скачок в математике — AIME 2025 87.5% против 70% у первой R1 — и результаты на уровне OpenAI o3 и Gemini 2.5 Pro. Открытые веса под MIT. Позже линейка ушла в DeepSeek V3.1 с гибридным мышлением.
Рейтинг и бенчмарки
Входные и выходные данные
API и стоимость
Способы доступа
Сценарии использования
Тарифы и подписки — DeepSeek
Актуальные планы подписки провайдера. Цены могут меняться — уточняйте на странице цен
- Чекпойнты на Hugging Face (MIT)
- Коммерческое использование без ограничений
- Есть дистиллированная версия под слабое железо (Qwen3-8B)
- Запуск через vLLM / SGLang
- Режим deepseek-reasoner (глубокое мышление)
- Кеширование входа даёт скидку
- Контекст 128K, вывод до 64K
- OpenAI-совместимый API
- OpenRouter, Together AI и др.
- Без своего железа
- Доступ для РФ через агрегаторы
Плюсы и минусы
Подробный обзор
Что такое DeepSeek R1-0528
DeepSeek R1-0528 — обновлённая версия знаменитой reasoning-модели DeepSeek R1, выпущенная 28 мая 2025 года. Как и оригинал, это Mixture-of-Experts на 671 млрд параметров с 37 млрд активных на токен, но с заметно улучшенными рассуждениями, глубиной вывода и надёжностью ответов. Модель «думает» вслух — строит длинную цепочку рассуждений перед ответом — и особенно сильна в математике, логике и алгоритмических задачах.
Что улучшилось
- Математика — AIME 2025 вырос с 70% до 87.5% (+17.5 п.п.); модель стала тратить на задачу больше «размышлений» (в среднем ~23K токенов против ~12K)
- Наука и код — рост на GPQA-Diamond (+9.5), LiveCodeBench (+9.8) и Aider-Polyglot (+18.3)
- Уровень — по ряду тестов вплотную подошла к OpenAI o3 и Gemini 2.5 Pro, оставаясь при этом открытой
- Доступность на слабом железе — вышла дистиллированная версия на базе Qwen3-8B для запуска на одной GPU
Актуальность в 2026
R1-0528 остаётся сильной и полностью открытой reasoning-моделью, но это версия мая 2025 года. Позже DeepSeek выпустила DeepSeek V3.1 с гибридным мышлением, где обычный и reasoning-режимы объединены в одной модели. Если нужна свежая универсальная модель — смотрите на V3.1; если важна именно классическая «думающая» R1 с открытыми весами под MIT — R1-0528 по-прежнему отличный выбор для математики, логики и исследований.
Доступность в России
Модель доступна в России: сервис DeepSeek (chat.deepseek.com) не заблокирован, а открытые веса под MIT можно скачать с Hugging Face и запускать локально без аккаунтов и карт. Барьер — оплата официального API: российские карты не принимаются, поэтому платный доступ проще получить через сторонние агрегаторы (OpenRouter) или сервисы с рублёвой оплатой. Русский модель понимает, но «думает» и отвечает точнее на английском.