Минусовка из любой песни за три минуты: как это делается и где подвохи
Вечер вторника, письмо от классного руководителя: к пятнице нужна минусовка на песню, которую выбрала дочь. В сети находятся синтезаторная перепевка, минус в другой тональности и ролик, где поверх поёт кто-то другой. Из самой песни голос убирается за пару минут, и ниже я показываю, как именно.
Песню для конкурса выбирают по голосу и настроению, а не по тому, есть ли на неё минус. Поэтому в нужный момент минуса нет: у известных песен лежат перепевки на синтезаторе, у редких — ничего. Караоке-версия с другой тональностью тоже не выход: ребёнок разучивал под оригинал.
Та же история у взрослых. Корпоратив, где кто-то решился спеть. Репетиция кавера, когда барабанщик заболел, а играть под пластинку с голосом неудобно. Домашнее караоке в субботу, когда хочется не «похожую аранжировку», а ту самую запись, только без певца.
Во всех этих случаях исходник один и тот же: сама песня. Из неё и делают минус.
Почему старый способ давал глухой минус
До нейросетей голос убирали трюком со стереоканалами. Певца при сведении обычно ставят в центр, одинаково в левый и правый канал. Если один канал вычесть из другого, всё центральное исчезает. Голос пропадает.
Вместе с ним пропадают бас и бочка: их тоже ставят в центр. Оставались размазанные по краям гитары и тарелки, и минус звучал так, будто его слушают из-за стены. Петь под такое можно, выступать — нет.
Нейросеть работает иначе. Она училась на песнях, у которых были известны отдельные дорожки: вокал, ударные, бас, всё остальное. Модель смотрит на звук как на картинку: по горизонтали время, по вертикали высота, яркость — громкость. На такой картинке у голоса свой рисунок: полосы гармоник, дрожание вибрато, шумные пятна согласных.
Модель отмечает на этой картинке участки, похожие на голос, и собирает из них отдельный файл. Всё остальное идёт в минус. Бас и бочка при этом остаются на месте, потому что модель различает их с голосом по рисунку, а не по положению в стерео.
Что подготовить
Формат — mp3, wav, m4a, flac или ogg. Файл до двадцати мегабайт, это около десяти минут звучания. Обычная песня из альбома укладывается с запасом даже во flac.
Качество исходника решает больше, чем кажется. Лучший вариант — файл из купленного альбома или lossless. Хуже всего — mp3, скачанный из ролика на видеохостинге. Такой файл сжимали трижды: при загрузке ролика, при показе в плеере и в сервисе «скачать mp3». Каждое сжатие срезает тихие высокие частоты. Именно по ним модель отличает шипящие в голосе от тарелок, и без них она чаще ошибается: часть голоса остаётся в минусе.
У роликов есть и второй подвох. Звук из клипа не всегда совпадает с альбомной версией: там бывают шумы, реплики, обрезанное вступление. Если песня нужна в том виде, в каком её знает зал, брать её лучше из аудиоальбома.
Караоке-версии и уже готовые чужие минусы загружать нет смысла. Голоса в них нет, и модели нечего отделять.
Порядок работы
- Откройте страницу с инструментом на сайте. В правом нижнем углу живёт Мастер — кузнец в фартуке.
- Нажмите «Минусовка из песни» или прикрепите файл скрепкой. С аудиофайлом Мастер поймёт задачу сам.
- Подождите две-три минуты. Машина с видеокартой сначала просыпается, потом считает.
- Послушайте отрывок в тридцать секунд: оригинал и минус рядом, чтобы сравнить. Лучше в наушниках и на самом громком припеве — если призрак голоса есть, он там.
- Заберите полные файлы. Их два: минусовка и голос отдельно, оба в mp3 на 320 килобит — это потолок качества для формата.
Одна минусовка бесплатна, регистрации и почты не нужно. Загруженная песня и результат удаляются с сервера через три дня.
Второй файл, с голосом, для караоке не нужен, но выбрасывать его не стоит. По нему удобно разучивать партию: слышно каждый вдох и каждую съеденную согласную, которые в миксе прячутся за гитарами.
Где минус выходит грязным
Плотный микс. Стена гитар, синтезаторные подложки, голос, записанный дважды и наложенный сам на себя. Здесь голос и инструменты занимают одни и те же частоты, и модель оставляет в минусе тихий след певца. Слышно его в паузах между фразами. Когда поверх поёт живой человек, след перекрывается.
Бэк-вокал и хор. Модель ищет голос вообще, а не конкретного певца. Бэки уходят в файл с голосом вместе с солистом, но не целиком: часть остаётся в минусе размытым фоном. Хор из десятков голосов по рисунку похож на синтезаторную подложку, и его модель делит между двумя файлами почти наугад.
Живые записи. Гул зала, аплодисменты, подпевающая публика. Голос певца размазан по реверберации помещения, и модель убирает прямой звук, а хвост частично оставляет. Студийная запись той же песни разделится чище.
Реверберация в студии. В балладах на голос вешают длинное эхо. Само слово уходит в файл с голосом, а его отзвук растворяется в инструментах, и часть отзвука остаётся в минусе. На громкости зала это едва заметно, в наушниках — слышно.
Минус для домашнего караоке, школьного зала и своей репетиции — личное использование записи. Публичное исполнение чужой песни и публикация записи с таким минусом — вопрос к правообладателю. Ответ на него у каждой песни свой, и в статье его нет.
Песня, под которую хочется спеть, обычно уже лежит в телефоне. Минус к ней — три минуты ожидания в мастерской и один файл. Дальше всё зависит от голоса, а не от техники.
Сделать это онлайн
Все эти нейросети — в одном сервисе
Kling, Veo, Runway, Luma, Sora, Topaz и ещё сотня моделей: один баланс, оплата в рублях, работает в браузере и в Telegram. В Telegram-боте по ссылке с сайта — 15 стартовых токенов вместо 5.
Промокод −15% на первую оплату: нажмите, чтобы скопировать, и введите при оплате · количество ограничено
Сборник промтов — бесплатно. Формулы для картинок и видео с разбором, какая часть за что отвечает. Забрать в телеграм-боте.
Забрать в боте