Google встроил генерацию музыки в Gemini: модель Lyria 3.5 уже доступна

Музыкальная индустрия несколько лет наблюдала за тем, как стартапы вроде Suno и Udio строят аудиторию на генеративной музыке. Google все это время держался в стороне с инструментами, до которых надо было специально добираться. 4 сентября это изменилось: Lyria 3.5 теперь живет прямо внутри Gemini - там, где сотни миллионов человек уже проводят время.
Что умеет Lyria 3.5
Модель генерирует стереозвук с частотой 44,1 кГц - это стандарт CD-качества, не какой-то сжатый превью. Пользователь описывает жанр, выбирает между вокалом и инструменталом, задает длину трека. Коротких клипов для превью или полноценных многоминутных песен - оба варианта доступны. Структура при этом нормальная: куплет, припев, бридж, а не просто зацикленный фрагмент.
Технически в API существуют две версии. Lyria 3 Clip (идентификатор `lyria-3-clip-preview`) всегда выдает 30-секундные клипы - для петель и быстрых набросков. Lyria 3.5 (`lyria-3.5`) строит полноценные треки длиной до трех минут с развитой структурой. Оба возвращают MP3 по умолчанию, Lyria 3.5 дополнительно отдает WAV.
Есть и мультимодальность: разработчик может передать до 10 изображений вместе с текстовым промптом, и модель сочинит музыку под визуальный ряд. Для видеоблогеров и авторов контента - очевидный сценарий использования.
Где это работает
Lyria 3.5 доступна глобально через веб-версию и мобильное приложение Gemini. Отдельно - в Google Flow Music для музыкантов и AI-креаторов, в Google AI Studio для разработчиков, в Google Vids для видеопроизводства.
Для российских пользователей ситуация стандартная для сервисов Google: Gemini работает через браузер, но с периодическими ограничениями по геолокации. Часть функций требует VPN, API-доступ через Google AI Studio для российских карт закрыт - нужна зарубежная оплата или обходные схемы через облачные кредиты.
Контекст: кто давит на кого
Suno и Udio за два года собрали реальную аудиторию и параллельно нарвались на судебные иски от звукозаписывающих лейблов. Udio в итоге заключила лицензионное соглашение с Universal Music Group - это дорого и сложно. Google заходит с другой позиции: компания прямо заявляет, что Lyria обучена только на лицензированном контенте. Это важный сигнал для индустрии, хотя конкретику о том, чьи каталоги использовались, Google не раскрывает.
Распределение - главный козырь. У Suno нет встроенного канала к аудитории такого масштаба. Когда функция генерации музыки появляется внутри чата, которым пользуются для работы и учебы, она превращается в случайное открытие для людей, которые никогда не искали музыкальный AI-инструмент специально. Это другая динамика роста.
OpenAI тоже экспериментирует с аудио, но до полноценной текстово-музыкальной генерации в массовом продукте пока не дошел. Так что Lyria 3.5 в Gemini - это реальная дифференциация, а не просто догоняющий шаг.
Ограничения, о которых честно написано в документации
Промпты проходят через фильтры безопасности. Запросы на конкретные голоса артистов или воспроизведение защищенных текстов блокируются - это прямое следствие юридических рисков, которые уже материализовались у конкурентов.
Генерация одноразовая: итеративное редактирование через серию промптов пока не поддерживается. Создал трек - получил результат. Если не понравилось, пишешь новый промпт с нуля. Для профессионального использования это серьезное ограничение, для casual-пользователя - приемлемо.
Результаты между запусками могут отличаться. Это не баг, это природа генеративных моделей, но для бренд-джинглов или повторяемых сценариев нужно иметь это в виду.
Про водяные знаки в официальных материалах ничего конкретного нет - открытый вопрос, который станет важным, когда AI-треки начнут массово заливаться на стриминговые платформы.
Что это значит на практике
Для разработчиков - готовый API для встраивания музыкальной генерации в свои продукты без необходимости строить модель с нуля. Для создателей контента - быстрые подложки под видео, персонализированные треки, джинглы за минуты. Для обычного пользователя Gemini - новая игрушка, которую можно попробовать прямо сейчас, не переходя ни на какой другой сервис.
Самый интересный долгосрочный вопрос - что происходит с профессиональными музыкантами и продакшн-компаниями, которые зарабатывают на фоновой музыке для видео, рекламы и подкастов. Этот сегмент рынка под давлением уже несколько лет, и Lyria 3.5 в Gemini этот процесс ускоряет.
Google сделал ставку на встраивание, а не на отдельный продукт. Та же логика сработала с генерацией изображений и видео внутри Gemini. Посмотрим, повторится ли история с музыкой - аудитория у инструмента есть с первого дня, и это главное преимущество.
Информация подтверждена несколькими независимыми публикациями, включая официальный блог Google и технические разборы со стороны профильных изданий.
Похожие новости
Suno v6: музыкальный ИИ переписан с нуля вместе с Warner и BMG
Suno запустила три новые модели v6, обученные на лицензированных данных Warner Music, BMG и Believe. Все старые модели отключены в тот же день.
Adobe Firefly стал полноценной студией: музыка, голос и звук в одном месте
Adobe вывела три ИИ-инструмента для работы со звуком в общий доступ и добавила Gemini Omni Flash - теперь Firefly закрывает весь творческий цикл без переключения между сервисами.
Google Lyria 3.5: редактируй треки по секциям, не начиная заново
Google выпустила Lyria 3.5 - теперь можно точечно переписывать отдельные части песни прямо в Flow Music, не трогая остальное. Это меняет все для музыкантов.