Suno: как написать песню с ИИ от идеи до готового трека
Suno делает песню целиком: музыку, аранжировку и вокал. Первый трек получается у всех, хороший — у тех, кто понял, чем управляет.
Человек пишет в поле «грустная песня про осень», нажимает кнопку и через минуту слушает готовый трек с вокалом. Первое впечатление — восторг. Второе, через три попытки, — все песни звучат одинаково.
Разница между восторгом и результатом в том, сколько вы отдали модели на её усмотрение.
Три вещи, которыми вы управляете
Текст. Можно отдать модели, можно написать свой. Свой текст меняет всё: именно он отличает вашу песню от сотни похожих. Модель с чужим текстом пишет обобщённо, потому что не знает ваших деталей.
Стиль. Не «грустная песня», а конкретика: жанр, темп, инструменты, характер вокала, эпоха звучания. Чем точнее описание, тем меньше сюрпризов.
Структура. Куплет, припев, мост — это задаётся прямо в тексте пометками. Без них модель сама решает, где припев, и решает не всегда удачно.
Как описать стиль
Плохо: «грустная песня про осень, красивая».
Хорошо:
melancholic indie folk, slow tempo, acoustic guitar and soft piano, female vocal with breathy tone, light reverb, autumn mood, live room sound
В описании работают четыре слоя: жанр, темп, инструменты, характер вокала. Дальше можно добавить эпоху или характер записи, но не имя исполнителя. Имя артиста в промте — прямой путь к претензии, и сервисы такие запросы часто отклоняют.
Про свой текст
Тексты со структурными пометками модель разбирает заметно лучше:
[Verse 1] Первая строка вашего куплета Вторая строка [Chorus] Строки припева [Verse 2] ...
Что стоит учитывать при написании. Короткие строки поются чище длинных. Слова со сложными стечениями согласных модель проглатывает. Ударения иногда уезжают, и это лечится перестановкой слова в строке, а не повторной генерацией.
Русский язык Suno поёт хуже английского: произношение плавает, окончания смазываются. Помогает писать проще, без причастных оборотов и редких слов.
Почему вокал звучит чужим
Модель генерирует голос, а не вашу манеру. Это ключевое ограничение: получившийся исполнитель никак не связан с вами и не воспроизводится от трека к треку. Собрать альбом «одного артиста» напрямую не выйдет.
Обходной путь, который используют музыканты: Suno делает инструментал, а вокал записывается живьём и сводится поверх. Тогда трек звучит как ваш, а модель экономит вам аранжировку и студию.
Что идёт не так
Припев не выделяется. Причина — нет пометок структуры или слишком ровный текст. Припев должен отличаться от куплета длиной строк и ритмом.
Трек обрывается. Длинные песни модель иногда не дотягивает; проще сгенерировать части отдельно и соединить.
Все варианты похожи. Значит, описание стиля слишком общее. Добавьте инструмент, темп, характер записи — и разброс появится.
Голос не тот. Меняется описанием вокала: возраст, тембр, манера, дыхание в голосе. Полного контроля не будет, но диапазон заметно сдвигается.
Границы
Голос конкретного артиста воспроизводить нельзя. Это касается и промтов «в стиле такого-то исполнителя»: сервисы их фильтруют, а если что-то и проходит, использовать такой трек публично рискованно.
С авторскими правами на сгенерированное всё не так однозначно, как хотелось бы. Правила отличаются от сервиса к сервису и от страны к стране. Условия коммерческого использования стоит читать у того сервиса, где вы генерируете, а не в советах из интернета.
И про цену. Музыка считается дешевле видео, но дороже картинок, а песню редко делают с первого раза: обычно это пять-десять генераций, пока не сойдутся текст, стиль и вокал. Поэтому имеет смысл сначала довести текст, а уже потом крутить стиль — на готовом тексте перебор дешевле.
Все эти нейросети — в одном сервисе
Kling, Veo, Runway, Luma, Sora, Topaz и ещё сотня моделей: один баланс, оплата в рублях, работает в браузере и в Telegram. По ссылке с сайта — 15 стартовых токенов вместо 5.
Сборник промтов — бесплатно. Формулы для картинок и видео с разбором, какая часть за что отвечает. Забрать в телеграм-боте.
Забрать в боте