Что такое ИИ-каверы и клонирование вокала?
ИИ-кавер — это переработка существующей песни нейросетью: та же мелодия и текст, но новый голос, аранжировка или жанр. Клонирование вокала — отдельная технология, при которой модель учится подражать голосу конкретного человека (или артиста) и «поёт» им любой материал. Чтобы сделать кавер с ИИ, достаточно загрузить трек в Suno, Kits AI или ElevenLabs и выбрать голос; чтобы клонировать голос нейросетью — записать от 10 секунд до получаса чистой речи. По состоянию на август 2026 года технология перешла из разряда диковинки в индустрию: у Suno 2 млн платных подписчиков и 7 млн сгенерированных треков в день (Music Business Worldwide, 2026), а на Deezer полностью ИИ-треки составляют 44% всех новых загрузок (Deezer, 2026). При этом вокруг технологии идут крупнейшие иски лейблов, а платформы вводят обязательную маркировку — разобраться, где заканчивается творчество и начинаются проблемы с правами, важно до того, как вы опубликуете первый кавер.
Как работают ИИ-каверы и клоны вокала?
Под капотом ИИ-кавера две разные технологии, которые часто путают.
Voice-to-voice конверсия. Модель берёт существующую вокальную дорожку и «перепевает» её голосом заданного тембра, сохраняя мелодию, темп и ритмику. Так работают Kits AI и RVC (Retrieval-based Voice Conversion) — открытая модель, которую собирают энтузиасты. Вокальная дорожка обычно извлекается автоматически разделением на стемы.
Генерация по тексту и референсу. Модель пишет мелодию и поёт текст голосом, созданным из вашей записи. Suno в модели v5.5 (март 2026) научилась создавать кастомные голоса: голос проходит верификацию «совпади голосом со случайной фразой», чтобы сервис убедился, что голос принадлежит вам, и по умолчанию остаётся приватным (Suno Blog, 2026). ElevenLabs в своих Music и Vocals (2026) синтезирует песни голосом пользователя по референс-аудио длиной от 10 секунд до 5 минут (ElevenLabs Blog, 2026).
Ключевая разница: voice-to-voice работает с готовой записью, генерация создаёт новую звуковую волну. Но и в том, и в другом случае «голос» — это не просто звук, а объект, вокруг которого сегодня строится правовая практика (об этом ниже).
Какие сервисы умеют каверы и клоны вокала в 2026 году?
| Сервис | Тип | Чей голос можно клонировать | Русский вокал | Доступ из РФ | Цена |
|---|---|---|---|---|---|
| Suno v5.5 (Voices) | Генерация | Только свой (верификация голосом) | Да | Требует обхода оплаты | $10–30/мес |
| Kits AI | Voice-to-voice | 50+ лицензированных артистов + свой клон | Да | Требует обхода оплаты | от ~$10/мес |
| ElevenLabs Music/Vocals | Генерация | Свой голос, официальные вокалисты | Да | Требует обхода оплаты | от $5/мес |
| Mureka (O1/V6) | Генерация + ремейки | Свой голос для пения, AI-вокалисты | Да (V6 — 10 языков) | Частично | есть бесплатный план |
| Udio → Starstruck | Cover/Remix | Права принадлежат правообладателю артиста | Да | Требует обхода оплаты | планы 2026 |
| Yandex SpeechKit Brand Voice | Клон для речи (B2B) | Свой голос, ~30 минут записей | Да (RU/KK) | Да | корпоративный прайс |
| RVC (open-source) | Voice-to-voice | Любой, кого вы запишете | Да | Да (свой ПК) | бесплатно |
Suno. Лидер рынка: 2 млн платных подписчиков и $300 млн ARR (февраль 2026) (MBW, 2026). Кастомные голоса (Voices) — только на платных тарифах, 4 кредита за трек в период беты. Если вы публикуете трек с включённым Cover/Remix, другие пользователи могут генерировать с вашим голосом (Suno Blog, 2026).
Kits AI. Профессиональный voice-to-voice конвертер: 50+ голосов артистов, лицензированных для коммерческого использования, свой клон из 10–60 минут чистого аудио (обучение занимает меньше получаса), голосовой блендер и разделение на стемы (Kits AI Docs, 2026). Есть программа Kits Earn, которая платит владельцам голосов долю отчислений.
ElevenLabs. В Music v2 (май 2026) появились полноценные песни с вокалом, смена жанра внутри трека и Music Finetunes — адаптация модели под тембр автора за 5–10 минут. В Vocals (июль 2026) — генерация песен голосом пользователя с проверкой загрузок на нарушение авторских прав до генерации (ElevenLabs Blog, 2026).
Mureka. Китайский сервис (компания Kunlun Wanwei) с русскоязычным интерфейсом: клонирование собственного голоса для пения, официальные AI-вокалисты, ремейки песен своим голосом; модели O1 и V6 поддерживают 10 языков, включая русский (Mureka, 2026).
Starstruck (Udio). После урегулирования иска с Universal Music Group (октябрь 2025) Udio строит лицензированное приложение Starstruck: режимы Cover, Reimagine, Remix и Create, права на результат принадлежат правообладателю артиста, экспорт запрещён, встроены водяные знаки против загрузки на стриминги (MBW, 2026).
Открытая RVC. Голосовой конвертер, который сообщество запускает на своих GPU. Работает с русским, но требует навыков: обучение модели, датасет чистой записи, настройка шагов синтеза. Бесплатно, но ответственность за использование целиком на вас.
Для речевой озвучки своим голосом (не пения) есть отдельные инструменты — про них читайте в гайде по клонированию голоса для озвучки видео.
Как сделать ИИ-кавер: пошагово
- Подготовьте исходник. Чистый трек или качественная запись. Если есть только готовый микс — извлеките вокальную дорожку разделением на стемы (Moises, LALAL.AI, open-source Demucs).
- Создайте голос. В Suno — запишите или загрузите свой голос и пройдите верификацию. В Kits AI — выберите лицензированный голос артиста или обучите свой клон на 10–60 минутах записи.
- Запустите кавер. В Suno: выберите трек → режим Cover/Remix → свой голос. В Kits AI: загрузите вокал → выберите целевой голос → конвертируйте.
- Отберите результат. Генерируйте 2–4 варианта, слушайте внимательно: артикуляция, ударения в русских словах, финальные «дыхания» — типичные слабые места.
- Доработайте. Разделите на стемы и подправьте вокал или микс; нормализуйте громкость под стриминги (о том, как довести трек до релиза, читайте в гайде по сведению и мастерингу с ИИ).
- Проверьте права (см. следующий раздел) и только потом публикуйте.
Законно ли это? Иски лейблов и правила платформ
Вокруг ИИ-музыки идут крупнейшие судебные процессы, и их исход напрямую влияет на то, что разрешено пользователям.
Иск RIAA к Suno и Udio. Подан 24 июня 2024 от имени UMG, Sony и Warner: лейблы утверждают, что модели обучались на миллионах записей без лицензий, в первоначальной жалобе — 560 произведений (CourtListener, дело 1:24-cv-11611). По состоянию на июнь 2026 года UMG и Sony продолжают судиться с Suno, пытаясь добавить в иск 61 026 записей, найденных фингерпринтингом: при максимальной ставке $150 000 за произведение потенциальная ответственность вырастает с ~$84 млн до $9+ млрд; слушание по fair use назначено на июль 2026, новые сроки процесса — до апреля 2027 (MBW, 2026).
Урегулирования. UMG урегулировала иск с Udio (октябрь 2025); Warner в ноябре 2025 стала первым мейджором, заключившим лицензионное соглашение с Suno — артисты WMG получили opt-in-контроль над использованием имён, голосов и композиций (MBW, 2025). При этом американская федерация музыкантов (AFM) в июне 2026 подала иск к UMG и Warner: записи музыкантов лицензировались для обучения ИИ «без компенсации и указания авторства» (MBW, 2026).
Правила YouTube. С 18 марта 2024 года при загрузке нужно раскрывать реалистичный синтетический контент — ИИ-голоса, лица, события; систематическое нераскрытие ведёт к удалению или отключению монетизации (The Verge, 2024). С 15 июля 2025 ужесточена монетизация «неаутентичного контента» — массового ИИ-контента без существенного человеческого вклада (The Verge, 2025). С мая 2026 YouTube автоматически маркирует фотореалистичный ИИ-контент, если автор сам его не раскрыл (YouTube Blog, 2026).
Правообладатели могут запрашивать удаление ИИ-музыки, «имитирующей уникальный голос» артиста, с ноября 2023 года (MBW, 2023). Практический вывод: каверы голосом чужого артиста — всегда зона риска, даже если вы не монетизируете видео.
Что говорит российское право?
В Гражданском кодексе РФ голос прямо не назван объектом, но защита строится по нескольким направлениям (КонсультантПлюс, ГК РФ):
- Право автора и исполнителя на имя (ст. 1265, 1315 ГК) — использование голоса артиста в чужих произведениях может нарушать право на имя.
- Исключительное право на исполнение (ст. 1317 ГК) — запись и воспроизведение чужого исполнения без согласия запрещены.
- Охрана изображения (ст. 152.1 ГК) — применяется по аналогии, когда голос публично ассоциируется с конкретным человеком.
В сентябре 2024 года в Госдуму внесены законопроекты о защите голоса (№ 718834-8 — использование голоса, включая синтезированный, только с согласия; № 718538-8 — уголовная ответственность за мошенничество и клевету с дипфейками) (ТАСС, 2024). Рамочный закон об ИИ вступает в силу 1 сентября 2026 года: площадки с аудиторией 500 000+ пользователей в день обязаны дать возможность маркировать ИИ-контент (ТАСС, 2025).
Есть и мировой прецедент: Пекинский интернет-суд в апреле 2024 года впервые в мире признал синтезированный голос охраняемым, если публика ассоциирует его с конкретным человеком, и взыскал 250 000 юаней компенсации за ИИ-переработку голоса актрисы без её согласия (Linklaters, 2024).
Правила публикации каверов: платформенный чек-лист
Перед публикацией кавера проверьте по списку:
- Свой голос или лицензированный. Голос артиста без лицензии — зона риска независимо от монетизации: правообладатели могут запросить удаление ИИ-музыки, «имитирующей уникальный голос», с ноября 2023 года (MBW, 2023).
- Платный тариф сервиса. Коммерческая лицензия действует на платных тарифах (Suno Pro/Premier, Kits AI, ElevenLabs платные планы); бесплатный тариф — только личное использование.
- Маркировка ИИ. YouTube требует раскрывать синтетический голос при загрузке (с 18 марта 2024), с мая 2026 фотореалистичный контент маркируется автоматически; за систематическое нераскрытие — удаление или отключение монетизации (The Verge, 2024; YouTube Blog, 2026).
- Правила монетизации. С 15 июля 2025 массовый «неаутентичный контент» без существенного человеческого вклада не монетизируется — каверы «на потоке» с одним голосом и шаблонной картинкой попадают под эту категорию (The Verge, 2025).
- Российские площадки. По закону 243-ФЗ с 1 сентября 2026 платформы с аудиторией 500 000+ пользователей в день обязаны дать возможность маркировать ИИ-контент — маркируйте сами, не дожидаясь требований (ТАСС, 2025).
Рынок: насколько это массово?
- Suno: 100+ млн пользователей, ~7 млн треков в день — эквивалент каталога Spotify каждые две недели (MBW, 2026).
- Deezer: 75 000 полностью ИИ-треков в день = 44% всех новых загрузок (апрель 2026); при этом ИИ-треки дают лишь 1–3% стримов, а ~85% их прослушиваний признаны ботовым фродом; 97% слушателей в слепом тесте не отличают ИИ-трек от человеческого (Deezer, 2026).
- Оценки рынка генеративного ИИ в музыке сходятся на сильном росте: $750,6 млн в 2025 → $4,6 млрд к 2032 году (CAGR 29,5%) по оценке Research and Markets (Research and Markets, 2026).
Что можно, а что нельзя: сводка
| Сценарий | Статус |
|---|---|
| Кавер своим голосом, на платном тарифе Suno/Kits AI, для личного использования | ✅ Разрешено |
| Кавер своим голосом с монетизацией видео | ✅ Разрешено (коммерческая лицензия на платных тарифах + маркировка ИИ) |
| Кавер голосом живого артиста без лицензии | ⚠️ Зона риска: правообладатель может запросить удаление |
| Клонирование голоса знакомого/коллеги без согласия | ⛔ Нарушение (согласие обязательно, законопроекты 2024–2026) |
| Мошенничество с клонами голоса (обзвон, фейковые «мамы» в мессенджерах) | ⛔ Уголовная ответственность (законопроект № 718538-8) |
Итог: ИИ-каверы — легальный творческий инструмент, если вы используете свой голос (или официально лицензированные голоса), платный тариф сервиса и честно маркируете контент. Всё, что имитирует живых людей без их согласия, — за гранью.
Хотите собрать собственного ИИ-агента, который напишет текст песни, предложит идеи для кавера или спланирует релиз? Создайте агента под свою задачу на AgentHere — без программирования, за 5 минут.
Источники
- Suno Blog: v5.5, Voices и кастомные модели
- Music Business Worldwide: Suno — 2 млн подписчиков, $300 млн ARR
- Music Business Worldwide: спор о 61 026 записях Suno
- Music Business Worldwide: Starstruck — лицензированное приложение Udio
- Music Business Worldwide: иск AFM к UMG и Warner
- ElevenLabs Blog: Music v2 и ElevenLabs Blog: Vocals
- Kits AI Docs
- Yandex Cloud Docs: SpeechKit Brand Voice
- Пресс-центр Сбера: музыка в GigaChat
- Deezer Newsroom: ИИ-треки — 44% загрузок
- CourtListener: дело 1:24-cv-11611 (UMG v. Suno)
- The Verge: маркировка синтетического контента YouTube и The Verge: ужесточение YPP
- YouTube Blog: автодетекция ИИ-контента
- ТАСС: законопроекты о защите голоса, ТАСС: рамочный закон об ИИ
- КонсультантПлюс: ГК РФ, часть 4
- Linklaters: первое решение по ИИ-голосу
- Research and Markets: генеративный ИИ в музыке