Google DeepMind выпустила Lyria 3. Это модель для создания музыки. Она генерирует треки с вокалом и текстом.
Модель работает в приложении Gemini. Пользователь пишет запрос или загружает фото. Через две секунды получает 30-секундную песню.
Создание музыки сложнее текста. Нужно учесть мелодию, ритм и гармонию. Lyria 3 справляется с этой задачей.
Треки звучат цельно. Первая секунда не противоречит тридцатой. Это главное достижение модели.
Частота дискретизации — 48 кГц. Формат — стерео. Качество звука высокое.
Есть функция реального времени. Модель генерирует аудио двухсекундными фрагментами. Это похоже на живой джем.
Google создала Music AI Sandbox. Это набор инструментов для музыкантов. Можно преобразовать мелодию в оркестровую аранжировку.
Можно изменить инструмент, сохранив мелодию. Или превратить аккорды в хоровое пение. Это совместная работа человека и машины.
Каждый трек содержит цифровую подпись. Водяной знак вшит в аудиоволну. Его не слышно, но можно обнаружить.
Подпись останется даже после сжатия. Или если записать песню на диктофон. Это решает вопрос авторства.
Технология вышла из лаборатории. Теперь она доступна каждому. Музыку может создавать любой человек.