← Блог Гайд

AI cover: как сделать кавер песни нейросетью

· · 7 минут чтения
Микрофон и виниловая пластинка, превращающиеся в звуковые волны с подсветкой нейросети

Коротко. AI cover — это кавер песни, сделанный нейросетью. Под этим словом прячутся две разные задачи: заменить голос исполнителя другим голосом или переиграть трек в новом жанре и с новым вокалом. Первое делают модели клонирования голоса вроде RVC, второе — музыкальные нейросети, которые умеют работать с готовой дорожкой. Разбираем оба пути, что для них нужно и где проходит граница допустимого.

Что такое AI cover

В обычном кавере музыкант заново исполняет чужую песню. В AI cover исполнение делает нейросеть. Чаще всего встречаются два формата:

  • Замена голоса. Песню «поёт» другой человек или персонаж: из оригинала вырезают вокал, прогоняют через модель чужого голоса и кладут обратно на минус. Так появляются ролики, где известный рок-хит исполняет мультяшный герой.
  • Переаранжировка. Мелодия и слова остаются, а жанр, инструменты и вокал меняются: баллада становится синтвейвом, поп — акустикой. Здесь нейросеть генерирует новое звучание, а не подделывает конкретного певца.

Отдельно стоит пародия: свои слова на известный мотив. Это уже не столько кавер, сколько новая песня, и её проще всего делать нейросетью целиком.

Как сделать AI cover с заменой голоса

Классическая схема AI cover generator состоит из трёх шагов.

1. Отделить вокал от музыки

Нужны две дорожки: чистый голос и минус. Их получают нейросетевым разделением, например открытой программой Ultimate Vocal Remover. Качество всего кавера зависит от этого шага: если в вокале остались тарелки и эхо, модель голоса превратит их в металлический призвук. Как добиться чистого разделения, мы подробно разбирали в статье «Vocal remover: как отделить вокал от музыки».

2. Прогнать голос через модель

Модель голоса (чаще всего RVC — Retrieval-based Voice Conversion) обучают на 10–30 минутах чистой записи нужного человека. Она не поёт сама — она перекрашивает тембр исходного вокала, сохраняя мелодию, ритм и интонации. Поэтому важно, чтобы диапазон исходного певца был близок к целевому, иначе включают сдвиг высоты на несколько полутонов.

3. Свести дорожки

Новый вокал кладут на минус, выравнивают громкость, добавляют немного реверберации, чтобы голос «сел» в микс. Без этого шага кавер звучит так, будто певец стоит в соседней комнате.

Чужой голос: где граница

Голос человека — часть его личности, а песня — объект авторского права. Кавер с голосом реального артиста без его согласия рискует получить блокировку на YouTube и стримингах по жалобе правообладателя, а коммерческое использование — претензии. Безопасные варианты: собственный голос, голос друга с его разрешения, вымышленный персонаж или песня, права на которую у вас есть. Если же цель — просто услышать любимый трек в новом звучании, удобнее второй путь.

Переиграйте трек нейросетью

Музыкальные модели в Умке поют по-русски и работают с вашей дорожкой. Без VPN и подписки.

Открыть Умку →

Кавер в новом жанре: переаранжировка

Музыкальные нейросети умеют брать готовую дорожку и менять её звучание по описанию. Так работает модель «Вокал на готовый бит» в разделе музыки Умки. У неё два режима:

  • «Переиграть трек» — загружаете аудио, описываете новый стиль тегами («acoustic, female vocal, calm») и указываете, каким был исходник. Модель сохраняет общую структуру, но меняет аранжировку.
  • «Положить вокал» — загружаете свой бит или минус и вписываете слова. Нейросеть поёт их поверх вашей музыки, в том числе по-русски.

Честно о границах: это не клонирование конкретного певца. Голос будет новым, сгенерированным, а не голосом артиста из оригинала. Для замены тембра на голос определённого человека нужен RVC-путь из раздела выше.

Если нужна песня с нуля — пародия, поздравление, песня про кота — модель ACE-Step поёт по-русски по вашему тексту, а ElevenLabs Music даёт самое чистое сведение. Пошаговый гайд — в статье «Как создать песню нейросетью».

Какой способ выбрать

ЗадачаСпособСложностьЧто получится
Песню поёт другой конкретный голосРазделение + RVC + сведениеВысокая: нужна модель голосаОригинальная мелодия, новый тембр
Тот же трек в другом жанре«Вокал на готовый бит», режим переигрыванияНизкаяНовая аранжировка и вокал
Свои слова на свой бит«Вокал на готовый бит», режим вокалаНизкаяПесня на вашей музыке
Пародия или песня с нуляACE-Step или ElevenLabs MusicНизкаяПолностью новый трек
Караоке-минусVocal removerНизкаяМузыка без голоса

Советы для качественного кавера

  1. Берите исходник в лучшем качестве. WAV или MP3 320 кбит/с. Нейросеть не восстановит то, что выбросил кодек.
  2. Описывайте стиль конкретно. Не «сделай красиво», а жанр, темп, инструменты и тип голоса: «lofi, 80 bpm, rhodes piano, soft male vocal».
  3. Размечайте текст. Пишите [verse] и [chorus] перед куплетом и припевом — модель лучше держит структуру песни.
  4. Генерируйте несколько вариантов. Музыкальные модели нестабильны: из трёх попыток одна обычно заметно лучше.
  5. Текст пишите с языковой моделью. Попросите ChatGPT или Claude подогнать слова пародии под размер оригинала — слог в слог. Как это делать, рассказано в статье «Как сгенерировать текст песни нейросетью».

Сколько это стоит в Умке

Умка работает из России без VPN и подписки: пополняете баланс в рублях и тратите токены только на то, что сгенерировали. Цена трека зависит от модели и длительности. Текст для пародии стоит копейки: умный ответ ChatGPT или Claude — 33 токена, быстрый — 1 токен.

Пакеты: 725 токенов за 290 ₽, 1811 за 690 ₽, 4172 за 1490 ₽ и 11 700 за 3900 ₽. При регистрации дают 60 токенов, восемь моделей бесплатны. Подробно — на странице тарифов.

Вывод

AI cover с чужим голосом — это три шага: разделить дорожки, перекрасить вокал моделью RVC и свести. Работает, но требует модели голоса и осторожности с правами. Если хочется услышать песню в новом жанре или спеть свои слова на свой бит, проще взять музыкальную нейросеть: загрузили дорожку, описали стиль, выбрали лучший вариант.

Сделайте свой кавер

60 токенов в подарок, карта не нужна. Без подписки и VPN.

Открыть Умку →

Частые вопросы

Что такое AI cover?

Это кавер песни, исполненный нейросетью. Обычно так называют два формата: замену голоса исполнителя другим голосом с помощью модели вроде RVC и переаранжировку трека в новом жанре с новым сгенерированным вокалом.

Можно ли сделать AI cover бесплатно?

Да, если делать всё самому: Ultimate Vocal Remover и RVC — открытые программы, но им нужен мощный компьютер с видеокартой и время на настройку. Онлайн-сервисы проще, но обычно берут плату за каждый трек.

Законно ли использовать голос известного певца?

Без согласия артиста — рискованно. Песня защищена авторским правом, голос считается частью личности, и площадки удаляют такие каверы по жалобам. Для публикации безопаснее использовать свой голос, голос с разрешения владельца или вымышленного персонажа.

Может ли нейросеть спеть на русском?

Да. Модели ACE-Step и «Вокал на готовый бит» в Умке поют по-русски по вашему тексту. Чтобы слова звучали чётче, размечайте куплеты и припевы и пишите текст без сложных сокращений.