Попробовать

Главная → Блог

Минусовка из любой песни за три минуты: как это делается и где подвохи

Ден Ах · 22 сентября 2026

Вечер вторника, письмо от классного руководителя: к пятнице нужна минусовка на песню, которую выбрала дочь. В сети находятся синтезаторная перепевка, минус в другой тональности и ролик, где поверх поёт кто-то другой. Из самой песни голос убирается за пару минут, и ниже я показываю, как именно.

Песню для конкурса выбирают по голосу и настроению, а не по тому, есть ли на неё минус. Поэтому в нужный момент минуса нет: у известных песен лежат перепевки на синтезаторе, у редких — ничего. Караоке-версия с другой тональностью тоже не выход: ребёнок разучивал под оригинал.

Та же история у взрослых. Корпоратив, где кто-то решился спеть. Репетиция кавера, когда барабанщик заболел, а играть под пластинку с голосом неудобно. Домашнее караоке в субботу, когда хочется не «похожую аранжировку», а ту самую запись, только без певца.

Во всех этих случаях исходник один и тот же: сама песня. Из неё и делают минус.

Почему старый способ давал глухой минус

До нейросетей голос убирали трюком со стереоканалами. Певца при сведении обычно ставят в центр, одинаково в левый и правый канал. Если один канал вычесть из другого, всё центральное исчезает. Голос пропадает.

Вместе с ним пропадают бас и бочка: их тоже ставят в центр. Оставались размазанные по краям гитары и тарелки, и минус звучал так, будто его слушают из-за стены. Петь под такое можно, выступать — нет.

Нейросеть работает иначе. Она училась на песнях, у которых были известны отдельные дорожки: вокал, ударные, бас, всё остальное. Модель смотрит на звук как на картинку: по горизонтали время, по вертикали высота, яркость — громкость. На такой картинке у голоса свой рисунок: полосы гармоник, дрожание вибрато, шумные пятна согласных.

Модель отмечает на этой картинке участки, похожие на голос, и собирает из них отдельный файл. Всё остальное идёт в минус. Бас и бочка при этом остаются на месте, потому что модель различает их с голосом по рисунку, а не по положению в стерео.

Что подготовить

Формат — mp3, wav, m4a, flac или ogg. Файл до двадцати мегабайт, это около десяти минут звучания. Обычная песня из альбома укладывается с запасом даже во flac.

Качество исходника решает больше, чем кажется. Лучший вариант — файл из купленного альбома или lossless. Хуже всего — mp3, скачанный из ролика на видеохостинге. Такой файл сжимали трижды: при загрузке ролика, при показе в плеере и в сервисе «скачать mp3». Каждое сжатие срезает тихие высокие частоты. Именно по ним модель отличает шипящие в голосе от тарелок, и без них она чаще ошибается: часть голоса остаётся в минусе.

У роликов есть и второй подвох. Звук из клипа не всегда совпадает с альбомной версией: там бывают шумы, реплики, обрезанное вступление. Если песня нужна в том виде, в каком её знает зал, брать её лучше из аудиоальбома.

Караоке-версии и уже готовые чужие минусы загружать нет смысла. Голоса в них нет, и модели нечего отделять.

Порядок работы

  1. Откройте страницу с инструментом на сайте. В правом нижнем углу живёт Мастер — кузнец в фартуке.
  2. Нажмите «Минусовка из песни» или прикрепите файл скрепкой. С аудиофайлом Мастер поймёт задачу сам.
  3. Подождите две-три минуты. Машина с видеокартой сначала просыпается, потом считает.
  4. Послушайте отрывок в тридцать секунд: оригинал и минус рядом, чтобы сравнить. Лучше в наушниках и на самом громком припеве — если призрак голоса есть, он там.
  5. Заберите полные файлы. Их два: минусовка и голос отдельно, оба в mp3 на 320 килобит — это потолок качества для формата.

Одна минусовка бесплатна, регистрации и почты не нужно. Загруженная песня и результат удаляются с сервера через три дня.

Второй файл, с голосом, для караоке не нужен, но выбрасывать его не стоит. По нему удобно разучивать партию: слышно каждый вдох и каждую съеденную согласную, которые в миксе прячутся за гитарами.

Где минус выходит грязным

Плотный микс. Стена гитар, синтезаторные подложки, голос, записанный дважды и наложенный сам на себя. Здесь голос и инструменты занимают одни и те же частоты, и модель оставляет в минусе тихий след певца. Слышно его в паузах между фразами. Когда поверх поёт живой человек, след перекрывается.

Бэк-вокал и хор. Модель ищет голос вообще, а не конкретного певца. Бэки уходят в файл с голосом вместе с солистом, но не целиком: часть остаётся в минусе размытым фоном. Хор из десятков голосов по рисунку похож на синтезаторную подложку, и его модель делит между двумя файлами почти наугад.

Живые записи. Гул зала, аплодисменты, подпевающая публика. Голос певца размазан по реверберации помещения, и модель убирает прямой звук, а хвост частично оставляет. Студийная запись той же песни разделится чище.

Реверберация в студии. В балладах на голос вешают длинное эхо. Само слово уходит в файл с голосом, а его отзвук растворяется в инструментах, и часть отзвука остаётся в минусе. На громкости зала это едва заметно, в наушниках — слышно.

Минус для домашнего караоке, школьного зала и своей репетиции — личное использование записи. Публичное исполнение чужой песни и публикация записи с таким минусом — вопрос к правообладателю. Ответ на него у каждой песни свой, и в статье его нет.

Песня, под которую хочется спеть, обычно уже лежит в телефоне. Минус к ней — три минуты ожидания в мастерской и один файл. Дальше всё зависит от голоса, а не от техники.

Все эти нейросети — в одном сервисе

Kling, Veo, Runway, Luma, Sora, Topaz и ещё сотня моделей: один баланс, оплата в рублях, работает в браузере и в Telegram. В Telegram-боте по ссылке с сайта — 15 стартовых токенов вместо 5.

Промокод −15% на первую оплату: нажмите, чтобы скопировать, и введите при оплате · количество ограничено

Сборник промтов — бесплатно. Формулы для картинок и видео с разбором, какая часть за что отвечает. Забрать в телеграм-боте.

Забрать в боте
Telegram · 15 токенов В браузере