Stability AI выпустила Stable Audio 3.0: треки до 6 минут на лицензионных данных

Когда ИИ наконец дорос до полноценного альбомного трека
Еще два года назад Stable Audio Open радовал максимум 47 секундами генерации - хватало разве что на джингл. Сегодня, 20 мая 2026 года, Stability AI объявляет о выпуске Stable Audio 3.0: семейства из четырех моделей, старшая из которых выдает 6 минут 20 секунд профессионально звучащей музыки с сохранением структуры и мелодической целостности. Это не просто итерация - это смена лиги.
Четыре модели под одним зонтиком
Architecture-wise компания разложила все по полочкам. Два "малыша" - Small SFX и Small, оба по 459M параметров - ориентированы на работу прямо на устройстве и генерируют треки до двух минут. Это честный on-device, без облака, без задержек - мечта разработчиков мобильных приложений и игр.
Medium (1,4B параметров) и Large (2,7B параметров) уже умеют создавать полноценные композиции на те самые 6:20 - с интро, развитием и аутро, удерживая тональность на протяжении всей длины. Для контекста: Stable Audio 2.0 из 2024 года мог генерировать примерно втрое меньше. Прогресс очевидный.
По модели доступа: Small SFX, Small и Medium выходят с открытыми весами - бери, изучай, дообучай. Large доступен только через API и self-hosting с платной подпиской. Компании с выручкой свыше $1 млн в год обязаны приобретать корпоративную лицензию. Стандартная практика для серьезных open-weight релизов - ничего неожиданного.
Лицензионный вопрос: главный нерв индустрии
Stability AI прямо заявляет: все модели семейства 3.0 обучены на полностью лицензированных данных. Это не случайная оговорка - это позиционирование. На фоне судебных баталий Suno и Udio с музыкальными лейблами, которые до сих пор не завершены, наличие лицензионной базы становится конкурентным преимуществом, а не просто юридической формальностью.
Company уже работала в этом направлении: в 2024 году Stability AI подписала соглашения с Warner Music Group и Universal Music Group на совместную разработку моделей и инструментов для создания музыки. Это не декоративные партнерства - это фундамент для того, чтобы не оказаться в суде вместе с конкурентами.
Профессиональный сегмент: новый вектор
Здесь интересная деталь, которую легко пропустить. Stability AI анонсировала отдельный продуктовый пакет для профессиональных музыкантов, хотя конкретные функции пока не раскрываются. Параллельно компания наняла Итана Каплана - бывшего директора по цифровым технологиям Universal Audio и Fender - для руководства этим направлением.
Это симптоматично. Suno в начале года привлекла бывшего CEO Merlin Джереми Сироту, ElevenLabs переманила Дерека Курнуайера из Kobalt. Весь сектор AI-аудио сейчас активно хантит музыкальных топ-менеджеров - не для галочки, а потому что без понимания индустриальной специфики дорогу в профессиональный сегмент не проложить.
Конкурентная карта: кто рядом
Stability AI выходит на поляну, где уже плотно. Google развивает собственные аудио-инструменты, ElevenLabs двигается от TTS к полноценной музыкальной генерации, Suno и Udio уже имеют миллионы пользователей - при всех своих правовых рисках.
Главное отличие Stable Audio 3.0 - это комбинация открытых весов для исследовательского сообщества плюс лицензионная чистота плюс реальная длина трека. 6:20 против типичных 2-3 минут у конкурентов в открытом сегменте - это уже разговор о другом форматном пространстве. Полноценный поп-трек, саундтрек к короткометражке, джингл для бренда - все укладывается.
Что это значит для российских пользователей
Open-weight модели Small и Medium можно скачать и запустить локально - никаких географических ограничений, VPN не нужен. Large-модель через API - вопрос отдельный: российские карты на западных платформах традиционно не принимаются, придется искать обходные пути или работать через посредников.
Для indie-разработчиков и небольших студий Small-модели на 459M параметров - реальный инструмент: запускаются на потребительском железе, генерируют до двух минут, весовые файлы открыты. Это уже сейчас можно интегрировать в мобильные приложения, игры, инструменты для контент-мейкеров.
Мой вывод
Stability AI явно переориентировалась. После турбулентного 2023-2024 годов с финансовыми трудностями и сменой руководства компания нашла свою нишу: открытые модели с лицензионной чистотой как альтернатива закрытым коммерческим сервисам с правовыми рисками. Это умная позиция.
Прорывом Stable Audio 3.0 не назову - скорее зрелым продуктом, который закрывает реальные потребности. Шесть минут генерации, открытые веса для трех из четырех моделей, понятная корпоративная лицензия, легальная база данных. Для разработчиков и небольших команд это заслуживает внимания прямо сейчас.
Информация о выпуске подтверждена несколькими независимыми изданиями, освещающими рынок AI-аудио.
Источники
Похожие новости
Suno v6: новое семейство моделей, разработанное с Warner, BMG и Believe
Suno запустила три новые модели v6, разработанные с использованием лицензированных данных Warner Music, BMG и Believe. Все старые модели отключены в тот же день.
Google встроил генерацию музыки в Gemini: модель Lyria 3.5 уже доступна
Google запустил Lyria 3.5 прямо в приложении Gemini - теперь любой пользователь может создавать треки с вокалом и аранжировкой через обычный чат-запрос.
Adobe Firefly стал полноценной студией: музыка, голос и звук в одном месте
Adobe вывела три ИИ-инструмента для работы со звуком в общий доступ и добавила Gemini Omni Flash - теперь Firefly закрывает весь творческий цикл без переключения между сервисами.