MiniMax Speech 2.8
Озвучка текста от MiniMax (23 января 2026), занявшая первое место сразу в двух слепых рейтингах - Artificial Analysis Speech Arena и Hugging Face TTS Arena, обойдя OpenAI и ElevenLabs. Русский поддерживается, всего языков 40+. Клонирует голос по 10 секундам записи. Версия HD стоит $100 за миллион символов, ускоренная Turbo - $60.
Рейтинг и бенчмарки
Входные и выходные данные
API и стоимость
Способы доступа
Сценарии использования
Тарифы и подписки - MiniMax
Актуальные планы подписки провайдера. Цены могут меняться - уточняйте на странице цен
- Первый звук менее чем через 200 мс
- В 2-3 раза быстрее HD
- Для голосовых агентов и телефонии
- Все 40+ языков и эмоции
- Дешевле HD почти вдвое
- Студийное качество 32 кГц
- До 30 минут аудио за один запрос
- Богаче тембр и тоньше эмоции
- Для контента, который слушают люди
- 1-е место в слепых рейтингах
- Достаточно около 10 секунд записи
- Передает тембр, придыхание и темп речи
- Голос сохраняется для повторного использования
- Оплачивается отдельно от синтеза
- Создание голоса по описанию
- Без исходной записи
- Оплачивается отдельно
Плюсы и минусы
Подробный обзор
Что такое MiniMax Speech 2.8
MiniMax Speech 2.8 - модель синтеза речи, представленная 23 января 2026 года. Выходит в двух вариантах: speech-2.8-hd для качества и speech-2.8-turbo для скорости.
Первое место сразу в двух слепых рейтингах
Главный аргумент в ее пользу - не заявления разработчика, а результат слепых сравнений живыми слушателями. Версия HD возглавила одновременно Artificial Analysis Speech Arena и Hugging Face TTS Arena, обойдя модели OpenAI и ElevenLabs. Предыдущая версия 2.6 таких позиций не занимала.
Ценность именно в методике: люди слушают образцы, не зная, какая модель их произнесла, и выбирают тот, что звучит естественнее. Обмануть такой замер сложнее, чем табличный бенчмарк.
Русский язык работает - и это важно
Отдельно стоит подчеркнуть момент, критичный для русскоязычных задач. У многих топовых моделей озвучки русского нет вовсе или он звучит с заметным акцентом. MiniMax Speech 2.8 поддерживает русский, а также украинский - всего в списке больше 40 языков.
Русский входит в общий перечень, но отдельных замеров качества именно русской речи компания не публиковала. Первые места в рейтингах получены преимущественно на английских образцах, поэтому перед большим проектом стоит прогнать короткий тест на своем тексте.
Что умеет помимо чтения текста
- Девять эмоций - радость, грусть, гнев, страх, отвращение, удивление, спокойствие, ровная речь и шепот
- Звуковые теги, появившиеся именно в версии 2.8: смех, усмешка, кашель, покашливание, вздох и чихание расставляются прямо в тексте
- Клонирование голоса по записи примерно в 10 секунд - модель улавливает тембр, придыхание и характерный темп речи
- 17 готовых голосов, если свой не нужен
- Переработанный тракт синтеза - заметно меньше фонового шума и характерных "синтетических" призвуков, чем в версии 2.6
HD или Turbo - как выбрать
Разница между версиями простая и упирается в то, кто слушает результат:
- HD - студийные 32 кГц, до 30 минут аудио за один запрос, богаче тембр и тоньше эмоциональные оттенки. Берут под то, что будут слушать люди: ролики, курсы, аудиокниги, подкасты. $100 за миллион символов
- Turbo - первый звук приходит менее чем через 200 мс, в 2-3 раза быстрее. Это для голосовых агентов и телефонии, где важна не студийность, а мгновенный отклик в диалоге. $60 за миллион символов
Чтобы цифры стали понятнее: статья на 5000 знаков обойдется примерно в 50 центов на HD и 30 центов на Turbo. Клонирование голоса оплачивается отдельно - $1.50 за голос, создание голоса по описанию через Voice Design - $3.00.
Практичное применение: озвучка ИИ-видео
Есть сценарий, где эта модель закрывает конкретный пробел. Многие видеомодели выдают немой результат: Hailuo 2.3 звука не генерирует вовсе, Kling AI 2.5 Turbo тоже. А там, где звук есть, русского в липсинке обычно нет.
MiniMax Speech 2.8 позволяет озвучить такой ролик на русском, причем с нужной эмоцией и при желании собственным клонированным голосом.
Доступность в России
Сервис открывается из России без VPN, а модель доступна еще и через сторонние площадки - Replicate, fal.ai, Together AI. Барьер один: оплата. Бесплатного тарифа нет, а российские карты не принимаются - нужна зарубежная карта или посредник. Русского интерфейса и документации тоже нет.