Сообщество - Нейро-Музыка

Нейро-Музыка

444 поста 222 подписчика

Популярные теги в сообществе:

41

Создание музыки в нейросети Udio, подробная инструкция с примерами от сообщества

Друзья, всем привет! Меня зовут Илья, я основатель онлайн-нейросети для создания изображений ArtGeneration.me, техноблогер и нейро-евангелист. С самого детства я мечтал научиться играть на каком-нибудь музыкальном инструменте. Я делал много попыток: были две гитары (акустическая и электро), клавиши и даже электронные барабаны. Но мне всегда не хватало усидчивости, и я не чувствовал удовлетворения от освоения инструмента, поэтому забрасывал его. Пробовал также освоить Ableton и FL Studio, но они казались мне слишком сложными. В итоге, к 35 годам я научился играть только на варгане, хотя душа требовала большего — я очень люблю музыку и слушаю ее буквально 24/7.

Нейросети уже дали мне возможность создавать прекрасные изображения, и я думал, как было бы здорово, если бы можно было так же легко создавать музыку. И действительно, около 10 месяцев назад появились такие инструменты, как MusicGen и AudioCraft от Meta*.

Но эти модели генерировали всего 12 секунд, и качество их было очень низким, поэтому тогда я не увлекся этой темой. Вот как это звучало:

Позже появился Suno, генератор музыки, который успел наделать шума. Компания также сделала большой вклад в опенсорс, создав отличный голосовой движок Bark. Но мне по-прежнему не нравилось качество: музыка звучала как с автотюном, а голос был механическим. Но вот вышел Udio, и все изменилось. Я сам не мог поверить в то, что услышал. В буквальном смысле я залип на создание треков: за 5 дней сгенерировал 6 штук, на каждый из них ушли сотни попыток, но у меня получалось, и мне нравилось. А главное — нравилось и тем, кому я давал послушать свои треки.

Несмотря на существующие проблемы, такие как плавающая консистентность трека, невозможность скопировать сегмент и переиспользовать его, а также пока не запущенную загрузку собственных сэмплов, Udio все равно поражает, особенно учитывая, что это лишь начало. И сегодня мы с вами разберемся, как создать ваш первый трек и как здесь все работает. Поехали!

Технологическая основа Udio

Udio базируется на ранних моделях музыкальных нейросетей, таких как MusicLM и AudioGen. По сути, они работают по тому же принципу, что и популярные нейросети для генерации изображений, такие как Stable Diffusion или DALL-E. Основная идея заключается в том, чтобы представить музыку в виде последовательности дискретных токенов (своего рода "слов" в музыкальном языке), а затем обучить нейросеть предсказывать следующий токен на основе предыдущих и дополнительной информации, такой как текстовое описание желаемой музыки.

Процесс генерации музыки можно сравнить с тем, как Stable Diffusion создает изображения из случайного шума. Сначала нейросеть предсказывает общую структуру и характеристики музыки (аналог низкочастотных деталей изображения), а затем постепенно добавляет все более мелкие детали (высокочастотные компоненты). Однако, в отличие от двумерных изображений, музыка является одномерным сигналом, разворачивающимся во времени, поэтому для моделирования временных зависимостей используется многоуровневая архитектура Transformer.

Еще одно важное отличие — для управления генерацией музыки используется не только текстовое описание, но и информация о желаемой мелодии, которая может быть задана в виде образца (например, напеть мелодию). Это становится возможным благодаря отдельной модели, которая научилась находить общие паттерны между музыкой и соответствующими текстовыми описаниями и мелодиями.

В итоге, можно сказать, что MusicLM и AudioGen привносят идеи и подходы из генерации изображений в мир музыки, адаптируя их под особенности музыкальных данных. Они открывают новые возможности создания музыки на основе текстовых описаний и образцов мелодий, подобно тому как Stable Diffusion и DALL-E позволяют генерировать изображения по текстовым запросам.

Udio же пошел дальше своих предшественников, реализовав ряд усовершенствований и доработок:

  • Увеличена длительность генерируемых треков до 30 секунд вместо 12

  • Значительно улучшено качество звучания, устранен эффект "автотюна"

  • Добавлена возможность создания собственных текстов песен

  • Реализованы функции расширения треков и создания ремиксов

Благодаря этим улучшениям Udio стал гораздо более привлекательным и удобным инструментом для создания музыки, чем его предшественники. Далее мы подробно разберем, как работать с этой нейросетью и создавать свои музыкальные шедевры.

Основы работы с Udio

Создавать треки с помощью Udio очень просто. Просто введите описание того, что вы хотите создать, в поле prompt и нажмите Create. Например, введите "a jazz song about New York".

Если вы не знаете, что ввести, попробуйте нажать на иконку с игральной костью, чтобы заполнить поле prompt случайным примером.

Типичный prompt состоит из комбинации свободного текста и тегов. Например, в запросе "a song about summer rain, jazz, mellow, warm", "a song about summer rain" — это свободная часть, а "jazz", "mellow", "warm" — теги. Обратите внимание, что разные части prompt разделяются запятыми (,), точкой с запятой (;) или точкой (.). Prompt может содержать любое количество свободных частей и тегов в любом порядке.

Кроме того, prompt может содержать ссылку на стиль исполнителя, что упрощает описание музыки, которую вы хотите создать. Например, приведенный выше prompt можно расширить до:

"a song about summer rain, jazz, mellow, warm, in the style of Billie Holiday"

Обратите внимание, что Udio не генерирует песни с голосами исполнителей, а ссылка на стиль внутренне заменяется набором релевантных тегов.

Чтобы помочь вам с составлением prompt, под полем ввода текста вы найдете два типа предлагаемых тегов, на которые можно нажать, чтобы добавить их в prompt:

Автодополнения: Это предлагаемые дополнения тегов для текущего слова.

Предлагаемые теги (серый фон): Предлагаемые теги, которые дополняют текущий набор тегов, упорядоченные по релевантности. Предлагаемые теги — хороший инструмент для исследования, который может привести вас к интересным комбинациям, особенно если вы готовы пролистать их.

Как бы подробно ни были текстовые prompt, они не могут полностью определить реальное музыкальное произведение — один и тот же текст описывает бесконечное количество возможных аудиотреков. Поэтому, чтобы приблизиться к музыкальной идее, которая есть у вас в голове, вы можете создать несколько клипов с одинаковыми prompt (и другими настройками). По умолчанию Udio создает два варианта для каждого вводимого prompt.

Но даже этого часто недостаточно, поэтому состояние поля prompt не сбрасывается после нажатия Create. Это позволяет легко добавлять в очередь больше генераций с изменениями или без них.

Если вы не хотите продолжать работу с тем же prompt, нажмите Reset — поле prompt вернется в исходное пустое состояние. Хорошая возможность попробовать что-то новое и свежее!

Обратите внимание! Вы можете переместить курсор в любую часть prompt, и это изменит автодополнения соответствующим образом.

А еще Udio генерирует вот такие замечательные музыкальные видео которые удобно использовать в социальных сетях:

Советы по составлению prompt

Собственный текст песен и инструментальные партии

По умолчанию Udio автоматически выбирает подходящий текст для вашего prompt (это включает создание инструментальных треков, где это имеет смысл). Если вы хотите использовать свой собственный текст, выберите режим Custom в разделе текста prompt и введите свой текст в поле ввода, например:

Чтобы разнообразить свои творения, попробуйте добавить специальные дескрипторы, такие как [Verse], [Chorus], [Hook], [Guitar Solo] или [Drop]. Вы также можете указать бэк-вокал, используя скобки.

Совет: Не отчаивайтесь, если Udio не выдает именно то, что вы ищете, с первой попытки. Продолжайте нажимать Create — скорее всего, один из получившихся треков будет потрясающим.

Совет: Некоторые менее обычные комбинации тегов могут быть намного сложнее в реализации. Если повторная генерация не помогает, вы можете исследовать другие способы смешивания стилей — с помощью расширения трека или ремиксов.

Тексты песен не обязательно должны быть на английском языке. Вот некоторые из языков, которые распознает Udio: китайский, японский, русский, польский, немецкий, французский, итальянский. Попробуйте — это весело!

Если вы заметили, что модель неправильно произносит слово, вы можете разбить его на более простые фонемы. Еще одна проблема, с которой вы можете столкнуться — модель ставит ударение не на тот слог. Это можно исправить, выделив правильный слог непосредственно в тексте (например, в русском языке попробуйте написать "бетóномешалка" вместо "бетономешалка").

Чтобы принудительно сделать трек инструментальным, выберите режим Instrumental. Обратите внимание, что это не на 100% надежно, и иногда вы можете услышать звуки, напоминающие голос.

Расширение треков

Udio генерирует вашу музыку в разделах по 32 секунды. Таким образом, вы можете относительно быстро просмотреть несколько вариантов и решить, какой из них стоит расширить по длительности. Вы можете перейти в режим Extension, нажав кнопку Extend на странице трека или выбрав Extend Track в контекстном меню (щелчок правой кнопкой мыши по треку или нажатие на значок ...). В этом режиме поле prompt меняет свой внешний вид и предоставляет дополнительные элементы управления.

Одним из новых элементов, которые вы можете заметить, является область, отображающая исходный клип, который вы в настоящее время расширяете:

Помимо того, что это упрощает отслеживание того, над чем вы работаете, эта область также позволяет скопировать prompt, использованный для создания исходного клипа, нажав на значок копирования справа от трека. Обратите внимание, что по умолчанию основное поле ввода prompt предварительно заполнено исходным prompt. Это гарантирует, что расширение, которое вы собираетесь создать, соответствует по стилю оригиналу.

При этом вы можете изменить prompt на что угодно, и иногда это приводит к очень интересным результатам. Например, вы можете развить свой трек от спокойной акустической гитарной линии до ревущего гитарного соло, сопровождаемого тяжелыми искаженными пауэр-аккордами — этого легко добиться, используя различные теги жанров и инструментовки для разных разделов вашего трека.

Прежде чем расширять трек, вы можете выбрать конкретную часть, которую хотите использовать в качестве основы для расширения. Для этого нажмите на кнопку "Select Section" над формой трека. Затем выделите интересующий вас фрагмент, кликнув и перетащив маркеры начала и конца выделения. Выбранная часть будет подсвечена и станет отправной точкой для дальнейшего расширения трека.

Использование "Select Section" позволяет сосредоточиться на наиболее удачных или многообещающих элементах вашей композиции и развить их в полноценное музыкальное произведение. Это особенно полезно, если сгенерированный трек содержит как сильные, так и слабые части, и вы хотите построить свою композицию вокруг лучших фрагментов.
После выбора нужного фрагмента с помощью "Select Section" вы можете перейти к следующему шагу и указать направление расширения трека.

Вы можете выбрать направление расширения, нажав на один из вариантов в области Extension Placement:

Udio позволяет добавлять раздел либо до, либо после исходного клипа. Этот процесс можно повторять, чтобы построить цепочку до 10 разделов. Вы также можете добавить вступительный или заключительный раздел, что позволяет составлять полноценные треки.

Простейший рабочий процесс для создания законченной песни длительностью 1,5 минуты выглядит так:

  1. Сгенерируйте среднюю (основную) часть, используя обычный режим создания. Это "мясо" вашего трека, самый захватывающий раздел.

  2. Перейдите в режим Extension для только что созданного раздела.

  3. Выберите опцию Add Intro в области Extension Placement и нажмите Extend. Это создаст нарастание к вашему основному разделу. Полученный двухсекционный трек теперь длится 1 минуту.

  4. Перейдите в режим Extension для трека длительностью 1 минута.

  5. Выберите Add Outro и нажмите Extend. Вот и все — теперь вы создали музыкальное произведение, имеющее правильное начало и завершение. И оно полностью ваше!

Примечание: Вы можете в любой момент выйти из режима Extension и вернуться в обычный режим создания, нажав Create New.

Создание ремиксов треков

Еще одна классная возможность Udio — создание ремиксов. Ремикс — это тонкая или не очень тонкая вариация существующего клипа. Чтобы создать ремикс, сначала выберите подходящий трек (пока вы можете делать ремиксы только 30-секундных треков) и нажмите Remix либо на странице трека, либо в контекстном меню.

По сравнению со стандартным режимом создания, в поле prompt есть одна новая область:

Левая часть идентична области исходного клипа в режиме Extension, а ползунок в правой части позволяет контролировать силу эффекта ремикширования (Variance). В самом слабом положении, когда ползунок полностью слева, ремикширование не меняет исходное аудио. По мере перемещения ползунка вправо (после установки положения ползунка нажимайте Remix) эффект становится более заметным — определенные аспекты клипа начинают меняться. Малые значения силы в основном влияют на мелкие детали, оставляя общую структуру и гармонию оригинала нетронутыми. Например, вы можете заметить, что тембры инструментов и голосов слегка меняются, или появляются небольшие вариации в рисунке перкуссии. Более высокие значения силы вносят более значительные изменения, а крайнее правое положение ползунка дает результаты, которые почти не имеют сходства с исходным клипом.

По умолчанию, аналогично режиму Extension, начальный текст prompt заимствуется из исходного трека. Это полезно, если вы хотите, чтобы ремикс был в стиле, похожем на оригинал. Но ремикширование становится по-настоящему интересным, когда вы пробуете либо подкорректировать prompt, либо написать совершенно новый. Таким образом вы можете, например, добавить новый инструмент или пойти вразнос и создать совершенно новое смешение жанров. Возможности безграничны.

Помимо изменения prompt, как и в других режимах создания, вы также можете изменить текст песни. Однако, чтобы это хорошо работало, вам может потребоваться использовать относительно высокое значение Variance, особенно если вы существенно меняете текст.

Совет: Ремикширование полезно для исправления небольших ошибок в произношении.

Совет: Попробуйте сгенерировать несколько ремиксов для одного и того же значения Variance. Каждый из них будет отличаться друг от друга, но иметь примерно одинаковую степень сходства с оригиналом.

Редактирование треков с помощью Inpainting

Udio недавно представил новую функцию под названием Audio Inpainting, которая позволяет редактировать отдельные части сгенерированных треков. Вы можете выбрать до 4 сегментов одновременно для повторной генерации с учетом окружающего контекста. Это дает возможность исправлять ошибки, улучшать вокальные партии или сглаживать переходы между частями трека.

Чтобы воспользоваться функцией Inpainting, сначала выделите нужный участок трека с помощью инструмента "Select Section". Затем нажмите кнопку "Add Section" под областью "Extension Placement". Выбранный сегмент будет перегенерирован с учетом окружающих частей, что позволит органично вписать его в общую композицию. Обратите внимание, что Audio Inpainting доступен только для платных подписчиков Udio.

Совет: Используйте Inpainting для исправления небольших дефектов, например, фальшивых нот или резких переходов, чтобы довести свой трек до совершенства.

Управление длиной контекста с помощью Advanced Control

В разделе "Lyrics" интерфейса Udio есть дополнительная опция под названием "Advanced Control". Она позволяет настроить длину контекста (Context Length), которую нейросеть учитывает при генерации output.

Длина контекста определяет, какую часть окружающего трека модель принимает во внимание при создании нового фрагмента. Более длинный контекст может улучшить согласованность output и сделать переходы между куплетами и припевами более плавными. Однако это также затрудняет смену жанров или стилей внутри трека.

Напротив, более короткая длина контекста дает больше гибкости и позволяет создавать более разнообразные композиции, но за счет потенциальной потери согласованности.

По умолчанию параметр Context Length установлен на максимум шкалы, обеспечивая высокую повторяемость трека. Вы можете настроить его в соответствии со своими предпочтениями и целями, перемещая ползунок влево для более короткого контекста или вправо для более длинного.

Совет: Если вы хотите создать трек с несколькими разными частями или жанрами, попробуйте уменьшить длину контекста. Для более целостных и последовательных композиций увеличьте значение Context Length.

Уровни подписки и ограничения

Udio предлагает три уровня подписки с разными возможностями и ограничениями:

  1. Free: Бесплатный план с ограниченной дневной квотой на генерацию и базовыми функциями. Не требует кредитной карты.

    • 10 кредитов в день с дополнительными 100 кредитами в месяц

    • Стандартная очередь обработки

    • До 2 одновременных генераций (4 трека)

    • Создание ремиксов и расширение треков

  2. Standard ($10/месяц): Вводный пакет с увеличенным лимитом генерации, доступом к дополнительным функциям и приоритетной обработкой.

    • 1200 кредитов в месяц без дневного лимита

    • Приоритетная очередь обработки

    • До 3 одновременных генераций (6 треков)

    • Inpainting, собственное оформление обложек и аватары пользователей

  3. Pro ($30/месяц): Максимальный пакет с наибольшим количеством генераций, специальными функциями и ранним доступом.

    • 4800 кредитов в месяц без дневного лимита

    • Приоритетная очередь обработки

    • До 4 одновременных генераций (8 треков)

    • Все функции из стандартного плана

Дополнительные кредиты можно приобрести отдельно: 100 кредитов за $3 или 1000 кредитов за $25.

Примечание: Ежемесячные кредиты, предоставляемые в рамках платных планов, не накапливаются. Однако купленные отдельно кредиты являются частью вашего плана и остаются на балансе до тех пор, пока вы не израсходуете их.

Авторские права и коммерческое использование

  • Udio не претендует на право собственности на контент, который вы генерируете с помощью Udio в ответ на ваши запросы. Подробная информация о праве собственности на сгенерированный контент доступна в Условиях использования Udio.

  • Вы можете делиться контентом, созданным с помощью Udio, в социальных сетях, при условии, что контент не содержит защищенных авторским правом материалов, которыми вы не владеете или на использование которых у вас нет явного разрешения, а также при условии, что вы должным образом указываете, что контент был создан с помощью Udio.

  • Вы можете использовать контент, созданный с помощью Udio, в коммерческих целях (например, распространять сгенерированную музыку на стриминговых платформах, включать ее в монетизируемые видео на YouTube, лицензировать для использования в ТВ/фильмах/рекламе и т.д.), при соблюдении тех же условий, что и для некоммерческого использования.

  • Вы можете перезаписывать, семплировать или иным образом перерабатывать контент, созданный с помощью Udio, при соблюдении вышеуказанных условий.

Дополнительные советы и примеры от сообщества

Невербальные подсказки в текстах песен

Индикаторы структуры

  • Метки куплетов: [verse], [Verse 1], [verse 2]

  • Метки припевов: [pre-chorus], [chorus]

  • Другие метки разделов: [intro], [bridge], [outro], [breakdown], [Drop], [interlude], [buildup], [Refrain] (как сообщается, помогает с согласованностью), [sample], [Rhythmic flow with syncopation], [dance interlude], [interlude drop], [Chorus: Vocalist], [Verse: Vocalist]

Речь и описания голоса

Дополнительные описания

  • Теги инструментов: [guitar solo], [saxophone], [violin solo]

  • [Harmonica Break], [Harmonica Bridge] были замечены, сгенерированы ИИ, но, похоже, не оказали никакого влияния на песню

  • Описания музыкального стиля/тона/элемента

    • "[high energy, upbeat, fast-paced Balkan brass instrumental, exciting and exhilarating]" (Balkanski Istraživač by Rajko)

    • [record scratching], [vinyl scratching] и [dj scratching], похоже, работают, но непоследовательно

    • Множество интересных примеров в этой песне (Cosmic Synapse by Hastag Rich)

  • Установка первой подсказки как: tempo xxx bpm, похоже, работает довольно стабильно

  • Использование [fade out] в разделе outro даст приятный эффект затухания, если есть место после любого текста

  • Повторите припев [Chorus - Repetition of the chorus to reinforce the song's themes - "Repeated chorus with an added echo for depth"] пример: Udio | Heart of Revelry by drinko

Произношение

Разбивка слов на фонемы/слоги

Произношение по буквам аббревиатур, букв и чисел

Невербальные слоги

Примеры эффективных промптов и рабочих процессов

Вот несколько примеров эффективных промптов и подсказок для различных элементов песни:

[Verse] [Verse 1] [Verse 2]

[Verse 1: Voice One] [Verse 2: Voice Two]

[Chorus] [Chorus 1] [Chorus 2] [Chorus: Both Male Vocalists]

[Spoken Verse 1: Male Voice] [Dialogue 1: Female Voice 1]

[Spoken Word: Male Voice] [Spoken Word: Female Voice]

[Build: Male Vocalist] [Build: Female Vocalist]

[Chorus: 2x]

[Bridge]

[Pre=Chorus]

[Pre-Drop]

[Drop]

[Post-Drop]

[Verse 1: Male Vocalist]

[Verse 2: Female Vocalist]

[All:]

[Hook]

[Intro: Sound of train chugging]

[Chorus: Gunshots in the distance]

[Verse 1: With street ambiance]

[Pre-Dialogue]

[Instrumental Break]

[Build: Male Vocalist]

[Whispers in the dark]

[Chorus: All, Detective (Male), Siren (Female), (Chorus)]

[Dialogue Bridge]

[DETECTIVE (spoken)] [FEMALE SUSPECT (spoken)]

[Instrumental Streak]

[Whispers]

[Instrumental Break]

[Dialogue Interlude]

Вот несколько более развернутых примеров:

Пример 1:

[DETECTIVE]

Dim lit streets and secrets untold

[MOLL]

In shadows lies the heart that's so cold

[FEMME FATALE]

A dame in distress or a spy, who's to say?

[DETECTIVE]

Every clue leaves a trail, every whisper's a lead

[MOLL]

But the truth's in the eyes, in the lies that they feed

[FEMME FATALE]

Darling, trust isn't cheap in the games that we play

Пример 2:

[Spoken Word: Male Vocalist]

November the 3rd, 1955: This is Detective Harlan from the 8th Precinct, the case has taken a darker turn

Mysterious notes left at the crime scene, a cipher that no mind can discern. It's all leading back to one enigmatic dame. Could she be the spider weaving this web of lies?

[Spoken Word: Female Vocalist]

November the 3rd, 1955: This is Miss Loretta, singing at The Blue Moon the night in question. Sure, I saw the gent with the guilty eyes, trailing shadows longer than the night is young. But a lady keeps her secrets, unless the right question is sung.

[Background Music]

A haunting melody of a lone saxophone, strings swelling like the tide, a piano's tune that dances with the shadows on the wall, the pulse of the city at midnight in musical form.

Пример 3:

[Scene Dialogue]

MALE DETECTIVE:

We're gonna get close, gonna track leads

Through the twists and turns that this case needs

FEMALE PARTNER:

Gonna ask 'round, take some notes

Follow the trail where the shadow floats

Вот пример рабочего процесса от пользователя Reddit под ником Cordova:

  1. Обычно у меня есть хотя бы зародыш идеи для текста, в зависимости от того, первый ли это куплет, припев или что-то еще.

  2. В тегах я выбираю жанр и любые конкретные теги, определяющие предпочтения по инструментовке или вокалу. Например:
    outlaw country & honky tonk, male vocalist, female vocalist, acoustic guitar, close harmonies

  3. Затем я ввожу свои подсказки в поле **Custom** write your own lyrics. Текст в скобках обычно будет петься гармоническим голосом. Например:

    (Intro)

    [Instrumental Break]

    He's an outlaw by nature, (a rebel by choice.)

    With the wind in his hair, (and the dust on his boots.)

    Singing songs of freedom, (with his raspy voice.)

    He's an outlaw forever, (playing his roots.)

  4. Затем нажимаю generate. Если мне нравится одна из двух сгенерированных песен, я переименовываю этот файл и даю ему обложку, чтобы он выделялся в моем списке. Позже очищаю, удаляя все без обложки.

  5. Это упрощает расширение, потому что теперь я знаю течение песни и могу создавать свой текст в соответствии с подсказками для [Verse], [Pre Chorus], [Chorus] и [Bridge] и получать согласованный результат, соответствующий настроению песни.

  6. Я обнаружил, что лучше всего генерировать по 6-8 строк на раздел (в зависимости от количества слогов и течения), и там, где в итоге не хватает текста, я вставляю [Instrumental Break], [Guitar Solo] или [Interlude], чтобы заполнить пространство чем-то интересным для слуха.

    Чтобы лучше направлять ИИ, старайтесь использовать не только дескриптор вроде [verse], но и добавляйте максимум 2 слова для описания, например [harmonic male verse]. Не забывайте про скобки ( и ), которые часто генерируют приятное эхо.

Если ваш собственный текст — это средний куплет или припев, но его не хватит на полные 32 секунды, попробуйте добавить [Instrumental Break] или [Interlude] до или после текста, чтобы расширить раздел и не дать ИИ вставить импровизации или лирические артефакты.

Udio открывает безграничные возможности для создания музыки с помощью нейросетей. Даже без музыкального образования вы можете создавать полноценные композиции в несколько кликов. Простой интерфейс, генерация музыки по текстовому описанию, а также функции расширения треков и создания ремиксов делают Udio незаменимым инструментом для музыкантов, продюсеров и энтузиастов.

В будущем мы можем ожидать появления еще более продвинутых моделей, способных создавать более сложную и эмоционально насыщенную музыку. Но пока нейросети остаются мощным инструментом для воплощения наших творческих идей. Так что не бойтесь экспериментировать, пробовать новые подходы и делиться своими творениями с миром. В мире музыкальных нейросетей есть бесконечное пространство для творчества и самовыражения.

На этом у меня все. Искренне верю, что кто-то найдет в Udio свою творческую отдушину, как это удалось мне. Будем следить за развитием этих технологий. Если создадите что-нибудь классное, приглашаю запостить в наше сообщество Нейро-Музыка на Пикабу.

Я рассказываю больше о нейросетях у себя на YouTube, в Telegram и на Boosty. Буду рад вашей подписке и поддержке. Всех обнял. Удачных генераций!

*Организация Meta, а также ее продукты Instagram и Facebook, признаны экстремистскими и запрещены на территории РФ.

Показать полностью 13 5
2

ИИ-трек добрался до Billboard Hot 100 — а проверить его оказалось некому

ИИ-трек добрался до Billboard Hot 100 — а проверить его оказалось некому

Главный поп-чарт США впервые всерьёз столкнулся с вопросом, на который у него нет ответа: как отличить песню, написанную человеком, от песни, собранной генератором. Поводом стал трек «Rubberz» рэпера Fenix Flexin — он вышел 5 июня, добрался до 63-й строчки Billboard Hot 100 и стал самым успешным релизом в карьере артиста. А заодно — первым в истории чарта «допинговым» скандалом.

Улика, которую артист выложил сам

Сомнения появились сразу: слишком гладкий жанровый микс, слишком «идеальное» звучание — ровно то, что хорошо получается у полноформатных генераторов вроде Suno. Критик Anthony Fantano публично усомнился в человеческом происхождении трека. Но по-настоящему история взорвалась, когда музыкант Medasin выложил в TikTok подробный разбор. По его версии, основу песни сгенерировали в сервисе Treblo (до недавнего времени — Sonauto), затем прогнали через разделитель дорожек на четыре стема, а сверху доложили собственный вокал. Главное доказательство Medasin нашёл в публикациях самого Феникса: в имени файла со сниппетом, выложенным ещё до релиза, осталось слово «Sonauto». Отдельная деталь — сервис сменил название на Treblo буквально за два дня до выхода трека.

Опровержение, которое удалили

Феникс ответил видео с проектом в Pro Tools, где показал дорожки — мол, всё сделано классическим способом. Продюсер Purps on the Beat пошёл другим путём и заявил, что ИИ — просто инструмент, не хуже автотюна. Вскоре оба удалили свои посты. Не помогли и живые выступления: на концерте артист сбился на словах собственного припева, а в эфире шоу On the Radar пел под фонограмму.

Детекторы против неизвестного генератора

Показательнее всего повёл себя ИИ-детектор HumanStandard: сначала он определил «Rubberz» как частично человеческую работу. После того как выяснилось, что использовался малоизвестный движок Treblo, исследователь Раша Рахман переобучил модели — и новый вердикт был однозначным: трек сгенерирован полностью. То есть детекция работает ровно до тех пор, пока детектор знаком с конкретным генератором; стоит появиться новому — и он проходит мимо.

Почему это тупик, а не единичный случай

В июле коалиция лейблов — Universal, Warner, Sony, HYBE, BMG и другие — предложила чартам мира правила допуска: ИИ-трек попадает в рейтинг, только если преимущественно создан человеком, ИИ применён законно и нет накрутки стримов. Тогда же RIAA и IFPI ввели два ярлыка: «AI-Generated» для песен, сделанных целиком по промпту, и «AI-Assisted» — когда машина лишь помогала. Проблема в том, что формально эти правила не принял никто: ни Billboard, ни один стриминговый сервис. Никакой обязательной проверки на входе в чарт не существует.

Поэтому «Rubberz» до сих пор спокойно занимает своё место в Hot 100. Пока индустрия не договорится о стандартах детекции и о том, кто и на каком этапе обязан её проводить, каждая подобная история будет заканчиваться одинаково — перепиской в духе «докажи, что не робот» и удалёнными постами с обеих сторон.

🔗 Источник: The Verge

🎧 НЕЙРО-ЗВУК ● Генерация музыки и звуков

Показать полностью 1
5

Лейблы требуют не пускать ИИ-песни в чарты — но дверь закрыли не для всех

Лейблы требуют не пускать ИИ-песни в чарты — но дверь закрыли не для всех

Коалиция почти из дюжины звукозаписывающих компаний — Universal Music Group, Warner Music Group, Sony Music, HYBE, Believe, BMG и другие — предложила операторам музыкальных чартов по всему миру новые правила допуска треков. Смысл в том, чтобы отсечь от рейтингов то, что индустрия называет «AI slop» — потоковый машинный шлак.

Три условия допуска

По предложению лейблов, песня с участием ИИ может претендовать на место в чарте только если выполняются все три критерия: она преимущественно создана человеком, использование ИИ при её создании было явно законным, и трек не вызывает подозрений в манипуляции стримами или чартовыми позициями.

Последний пункт не случаен. Именно накрутка прослушиваний у синтетических треков и вывела индустрию из себя: отдельные полностью машинные композиции успевали забираться в верхние строчки Billboard и попадать в плейлисты Spotify.

Главное: это не запрет ИИ в музыке

Здесь важно не поддаться заголовкам. Речь идёт не о том, чтобы вычистить ИИ из музыки вообще, а о том, чтобы провести границу между двумя разными вещами.

10 июля 2026 года RIAA и IFPI запустили добровольную систему маркировки, где у трека в метаданных появляется один из двух ярлыков. «AI-Generated» — запись, целиком сгенерированная по текстовому промпту. «AI-Assisted» — запись, где основную творческую работу выполнили люди, а ИИ помог с отдельными выразительными элементами.

Из чартов предлагают вычищать первую категорию. Вторая остаётся полноценным участником индустрии. Для всех, кто использует Suno, Udio, Riffusion и подобные инструменты как часть своего процесса, а не как кнопку «сделать всё за меня», это принципиально разные новости.

Масштаб проблемы

Цифры объясняют нервозность лейблов. На стриминговые платформы ежедневно заливаются десятки тысяч сгенерированных песен. Только Spotify за прошлый год удалил более 75 миллионов спамных треков. На Deezer счёт ИИ-загрузок идёт на тысячи в день.

Платформы уже начали реагировать самостоятельно. TIDAL с 15 июля стал первым крупным сервисом, который перестал выплачивать роялти за записи, определённые как стопроцентно машинные.

Важная оговорка

Ни одно из этих правил пока не имеет силы. Ни Billboard, ни какой-либо стриминговый сервис формально предложение лейблов не принял, а система маркировки RIAA и IFPI остаётся добровольной. Это позиция индустрии и заявка на будущий стандарт, а не действующий регламент.

Фоном идут иски мейджоров против Suno и Udio за обучение моделей на музыке без разрешения правообладателей. Так что борьба за то, кем считать ИИ в музыке — инструментом или конкурентом, — только набирает обороты.

Источник: Engadget

НЕЙРО-ЗВУК ● Генерация музыки и звуков

Показать полностью

Не любишь, не хочешь смотреть

Привет!
Сварганила нейросетью клипчик, вдруг кому понравится.

Хотела совместить Анору и Анну Ахматову
Получилась как всегда ерунда.

Нейросеть по промту девушка робот вырастила киборга с базукой
Нафига он в этом клипе, ну вот нафига?

Настолько абсурдно и дико, что не поднялась рука удалить его, решила оставить.

6

Нейропесни

Здравствуйте.

Я конечно плохо разбираюсь во всем, что касается цифровой сферы, но нейромузыка стала для меня отдушиной и способом пережить самые черные времена моей жизни.

Сейчас, придя в себя, я захотела поделиться тем, что сделала. Да, мои здесь только тексты, но к сожалению ни петь, ни сочинять музыку я не умею(хотя и представляю, как должна звучать та или иная песня, я не могу написать музыку сама).

Если кому-то понравится, будет круто.

Не понравится - так хотя бы это будет где-то кроме моей личной фонотеки.

Не нашла, как добавить только треки, поэтому быстренько сгенерировала видео.

Показать полностью 1
5

21 миллион чужих песен: расследование вскрыло, на чём тайно учили ИИ-композиторов Suno и Udio

21 миллион чужих песен: расследование вскрыло, на чём тайно учили ИИ-композиторов Suno и Udio

Журналист The Atlantic Алекс Райзнер, который ведёт серию расследований о тренировочных данных ИИ, добрался до самого охраняемого секрета индустрии — что именно «слушали» нейросети вроде Suno и Udio, прежде чем научились писать музыку.

Четыре базы, которые прятали как зеницу ока. Реальные записи для обучения моделей компании держат под замком, называя их «проприетарными». Райзнер раскопал четыре гигантских датасета, что гуляют по рукам внутри сообщества разработчиков: один на 12 миллионов треков, второй на 9 миллионов, и два поменьше — примерно по 100 тысяч песен. Только первый из них пришлось бы слушать без остановки 91 год. Нашёл он их буднично — по ссылкам в научных статьях самих разработчиков и на сайтах обмена данными, где архивы скачаны уже тысячи раз.

Как именно качали. Три из четырёх баз — это списки ссылок на YouTube и Spotify. Само аудио выкачивают автоматическими инструментами, которые умеют обходить логины, рекламу и механизмы, приносящие деньги авторам, — это прямое нарушение правил площадок. Четвёртая база — MP3-файлы с Free Music Archive.

Внутри — фактически вся история записанной музыки. Тейлор Свифт, Nirvana, Билли Айлиш, the Beatles, Bad Bunny, Pearl Jam, Элвис Костелло, Шерил Кроу. Джаз — Майлз Дэвис, Джон Зорн, Виджей Айер. Классические композиторы. И десятки тысяч мелких артистов всех жанров и эпох вперемешку.

Главная улика — не «вдохновение», а копирование. Suno уже неоднократно выдавал треки, до боли похожие на «Thriller» Майкла Джексона, «Shape of You» Эда Ширана, «Johnny B. Goode» Чака Берри, «Rock Around the Clock» и «The Thrill Is Gone» Би Би Кинга. Эти примеры — из иска, поданного крупнейшими лейблами против Suno. То есть модель не абстрактно «училась на стиле», а воспроизводила конкретные чужие произведения почти дословно (один из промптов так и звучал: «исполнитель, который рифмуется с fred sheeran»). Представитель Suno Рэйчел Ракусен в ответ сослалась на «защитные механизмы против несанкционированного копирования» и пост продакт-директора в LinkedIn, где сказано, что воспроизведение обучающих данных «не должно происходить». На вопросы про иск и конкретные использованные треки компания не ответила.

Что признали сами гиганты. Из-за секретности доказать, кто что использовал, обычно невозможно. Но кое-что всплыло: Google в 2022 году обучил модель на 44 миллионах треков — это 42 года непрерывной музыки — и открыто писал, что брал более 100 000 песен с Free Music Archive (бесплатных лишь для личного прослушивания, но платных для коммерции). Suno в судебном документе 2024 года признал, что учился на «практически всех музыкальных файлах приемлемого качества», которые смог скачать из интернета. А OpenAI ещё в 2020-м скачал 1,2 миллиона песен для модели Jukebox.

Почему это важно. ИИ-музыка уже затопила стриминг: Spotify прошлой осенью удалил 75 миллионов «спамных» сгенерированных треков, а сервис Deezer сообщает, что почти половина свежих ежедневных загрузок — это ИИ. При этом ни Spotify, ни YouTube, ни Amazon Music не маркируют такие треки. В судах Suno и Udio прикрываются доктриной «добросовестного использования» (fair use). Но это расследование впервые показывает не отдельные эпизоды, а масштаб: в машину залили не пару плейлистов, а почти всю записанную человечеством музыку — без спроса и без оплаты авторам. Прецедент уже рядом: похожий спор о книгах закончился предварительным соглашением с Anthropic на 1,5 миллиарда долларов.

🔗 Источник: The Atlantic (расследование Алекса Райзнера)

🎯 НЕЙРО-ПУШКА ● Новости и обзоры нейросетей

Показать полностью
1

День независимости

Привет, сделала клипчик на свои стихи при помощи нейросети сонграйтер.
Прошу поддержать.

А если города не будет?
А если сад не расцветёт?
Насмешливые уйди-уйди
проверещат: "старьё берём",
и наш кирпичный жёлтый дом
в зевке ленивого заката
растает как бисквитный торт,
лишь свечки - восковые плаксы -
оставив в небе дотлевать...
Не сосчитать. И задувать их
не хватит лет. Мой город ждёт.
В саду вовсю цветут сирени
и я у мамы на коленях,
малышка в белом летнем платье,
головку в бантах наклонив,
я пальчиком веду по строчкам...
А папа зол. Он выпить хочет.
И маме тоже не до книг.
Мой город праздничные дни
отметил. Чем опохмелиться?
Окурки, стеклотара, шприцы,
с балконов сыплются в листву.
Мне было б лучше не родиться.
Но мама... папа... Я живу!...
 

Показать полностью
Отличная работа, все прочитано!

Темы

Политика

Теги

Популярные авторы

Сообщества

18+

Теги

Популярные авторы

Сообщества

Игры

Теги

Популярные авторы

Сообщества

Юмор

Теги

Популярные авторы

Сообщества

Отношения

Теги

Популярные авторы

Сообщества

Здоровье

Теги

Популярные авторы

Сообщества

Путешествия

Теги

Популярные авторы

Сообщества

Спорт

Теги

Популярные авторы

Сообщества

Хобби

Теги

Популярные авторы

Сообщества

Сервис

Теги

Популярные авторы

Сообщества

Природа

Теги

Популярные авторы

Сообщества

Бизнес

Теги

Популярные авторы

Сообщества

Транспорт

Теги

Популярные авторы

Сообщества

Общение

Теги

Популярные авторы

Сообщества

Юриспруденция

Теги

Популярные авторы

Сообщества

Наука

Теги

Популярные авторы

Сообщества

IT

Теги

Популярные авторы

Сообщества

Животные

Теги

Популярные авторы

Сообщества

Кино и сериалы

Теги

Популярные авторы

Сообщества

Экономика

Теги

Популярные авторы

Сообщества

Кулинария

Теги

Популярные авторы

Сообщества

История

Теги

Популярные авторы

Сообщества

Недвижимость и ремонт

Теги

Популярные авторы

Сообщества