Google
МузыкаLyria 3.5Google Geminiгенерация музыкиGoogle AI StudioSuno

Google встроил генерацию музыки в Gemini: модель Lyria 3.5 уже доступна

Сергей Сергеев, редактор gen-hub.ru
Сергей Сергеев
Редактор gen-hub.ru
·4 мин чтения
Google встроил генерацию музыки в Gemini: модель Lyria 3.5 уже доступна

Музыкальная индустрия несколько лет наблюдала за тем, как стартапы вроде Suno и Udio строят аудиторию на генеративной музыке. Google все это время держался в стороне с инструментами, до которых надо было специально добираться. 4 сентября это изменилось: Lyria 3.5 теперь живет прямо внутри Gemini - там, где сотни миллионов человек уже проводят время.

Что умеет Lyria 3.5

Модель генерирует стереозвук с частотой 44,1 кГц - это стандарт CD-качества, не какой-то сжатый превью. Пользователь описывает жанр, выбирает между вокалом и инструменталом, задает длину трека. Коротких клипов для превью или полноценных многоминутных песен - оба варианта доступны. Структура при этом нормальная: куплет, припев, бридж, а не просто зацикленный фрагмент.

Технически в API существуют две версии. Lyria 3 Clip (идентификатор `lyria-3-clip-preview`) всегда выдает 30-секундные клипы - для петель и быстрых набросков. Lyria 3.5 (`lyria-3.5`) строит полноценные треки длиной до трех минут с развитой структурой. Оба возвращают MP3 по умолчанию, Lyria 3.5 дополнительно отдает WAV.

Есть и мультимодальность: разработчик может передать до 10 изображений вместе с текстовым промптом, и модель сочинит музыку под визуальный ряд. Для видеоблогеров и авторов контента - очевидный сценарий использования.

Где это работает

Lyria 3.5 доступна глобально через веб-версию и мобильное приложение Gemini. Отдельно - в Google Flow Music для музыкантов и AI-креаторов, в Google AI Studio для разработчиков, в Google Vids для видеопроизводства.

Для российских пользователей ситуация стандартная для сервисов Google: Gemini работает через браузер, но с периодическими ограничениями по геолокации. Часть функций требует VPN, API-доступ через Google AI Studio для российских карт закрыт - нужна зарубежная оплата или обходные схемы через облачные кредиты.

Контекст: кто давит на кого

Suno и Udio за два года собрали реальную аудиторию и параллельно нарвались на судебные иски от звукозаписывающих лейблов. Udio в итоге заключила лицензионное соглашение с Universal Music Group - это дорого и сложно. Google заходит с другой позиции: компания прямо заявляет, что Lyria обучена только на лицензированном контенте. Это важный сигнал для индустрии, хотя конкретику о том, чьи каталоги использовались, Google не раскрывает.

Распределение - главный козырь. У Suno нет встроенного канала к аудитории такого масштаба. Когда функция генерации музыки появляется внутри чата, которым пользуются для работы и учебы, она превращается в случайное открытие для людей, которые никогда не искали музыкальный AI-инструмент специально. Это другая динамика роста.

OpenAI тоже экспериментирует с аудио, но до полноценной текстово-музыкальной генерации в массовом продукте пока не дошел. Так что Lyria 3.5 в Gemini - это реальная дифференциация, а не просто догоняющий шаг.

Ограничения, о которых честно написано в документации

Промпты проходят через фильтры безопасности. Запросы на конкретные голоса артистов или воспроизведение защищенных текстов блокируются - это прямое следствие юридических рисков, которые уже материализовались у конкурентов.

Генерация одноразовая: итеративное редактирование через серию промптов пока не поддерживается. Создал трек - получил результат. Если не понравилось, пишешь новый промпт с нуля. Для профессионального использования это серьезное ограничение, для casual-пользователя - приемлемо.

Результаты между запусками могут отличаться. Это не баг, это природа генеративных моделей, но для бренд-джинглов или повторяемых сценариев нужно иметь это в виду.

Про водяные знаки в официальных материалах ничего конкретного нет - открытый вопрос, который станет важным, когда AI-треки начнут массово заливаться на стриминговые платформы.

Что это значит на практике

Для разработчиков - готовый API для встраивания музыкальной генерации в свои продукты без необходимости строить модель с нуля. Для создателей контента - быстрые подложки под видео, персонализированные треки, джинглы за минуты. Для обычного пользователя Gemini - новая игрушка, которую можно попробовать прямо сейчас, не переходя ни на какой другой сервис.

Самый интересный долгосрочный вопрос - что происходит с профессиональными музыкантами и продакшн-компаниями, которые зарабатывают на фоновой музыке для видео, рекламы и подкастов. Этот сегмент рынка под давлением уже несколько лет, и Lyria 3.5 в Gemini этот процесс ускоряет.

Google сделал ставку на встраивание, а не на отдельный продукт. Та же логика сработала с генерацией изображений и видео внутри Gemini. Посмотрим, повторится ли история с музыкой - аудитория у инструмента есть с первого дня, и это главное преимущество.

Информация подтверждена несколькими независимыми публикациями, включая официальный блог Google и технические разборы со стороны профильных изданий.

Все эти инструменты - уже на Genova-ai

Картинки, видео, музыка, голос и ИИ-чат в одном месте. Без VPN и зарубежных карт.

Картинки
Видео
Музыка
Голос
ИИ-чат
Попробовать бесплатно

Похожие новости