ИИ-удаление вокала и разделение на стемы

Mazmazika Удаление Вокала из Песен

Создавайте караоке-минусовки легко: разделите любую песню (YouTube, ссылки из соцсетей или MP3/WAV) максимум на 6 дорожек, пойте под синхронизированный текст, записывайте свои дубли и слушайте песню своим голосом благодаря клонированию голоса с ИИ. Быстрое и высокоточное выделение вокала с помощью передового ИИ.

О сервисе удаления вокала и караоке-студии Mazmazika

Сервис удаления вокала разбирает готовый микс обратно на составные части. Дайте ему песню с YouTube, SoundCloud, TikTok или Facebook либо загрузите MP3 или WAV, и нейросеть, обученная на тысячах многодорожечных записей, определит, какие части звука относятся к голосу, ударным, басу, пианино, гитаре и остальным инструментам. Каждую часть вы получаете отдельным файлом: чистый инструментал для караоке, акапеллу для ремикса или дорожку только с ударными для занятий.

И на разделении всё не заканчивается. Результат открывается в караоке-студии: текст подсвечивается слово за словом по ходу песни, вы можете записывать свои дубли поверх аккомпанемента, а клонирование голоса с ИИ исполнит песню вашим собственным голосом. Всё работает на серверах Mazmazika — движки «Ультра» и «Высокое качество» на GPU, — поэтому сервисом одинаково удобно пользоваться и на телефоне, и на ноутбуке, и ничего не нужно устанавливать.

Как это работает

  1. Вставьте ссылку или загрузите файл. Аудио скачивается и декодируется на сервере.
  2. Выберите движок и число стемов. «Ультра» разделяет песню на 2, 4 или 6 стемов (голос, ударные, бас, пианино, гитара и всё остальное); «Высокое качество» даёт самую чистую пару из голоса и инструментала; «Стандартный» — до пяти стемов. «Ультра» и «Высокое качество» выдают MP3 320 kbps.
  3. Включите «Синхронизированный текст», если нужны слова, и запустите обработку. Обычная четырёхминутная песня на «Ультра» готова меньше чем за минуту.
  4. Открывается студия: каждый стем — это дорожка со своей громкостью, панорамой, отключением звука, соло и эффектами, а караоке-экран показывает текст.
  5. Записывайте дубли, добавьте дорожку со своим голосом и скачивайте отдельные дорожки, весь микс или всё сразу — с эффектами или без. Сохранённый проект открывается ровно в том виде, в каком вы его оставили.

Для чего его используют музыканты

  • Караоке-вечеринки: уберите основной вокал, сохраните аккомпанемент в полном качестве и пойте с текстом на экране.
  • Занятия вокалом: записывайте дубль за дублем поверх оригинала, сравнивайте их дорожка за дорожкой и оставляйте лучший.
  • Услышьте, как песня прозвучит вашим собственным голосом, ещё до того, как вы её выучите, — с помощью клонирования голоса с ИИ.
  • Акапеллы для ремиксов, мэшапов и DJ-сетов.
  • Дорожки для занятий: отключите стем своего инструмента и играйте вместе с остальной группой.
  • Транскрипция и разбор: выделите бас, пианино или гитару, чтобы ясно услышать партию.
  • Вокальный коучинг: сравните дубль исполнителя с выделенным оригиналом.

Бесплатно vs Pro

Читается в реальном времени из текущих настроек планов, поэтому этот раздел всегда совпадает с тем, что инструмент применяет сегодня.

Посмотреть планы и актуальные цены

По сравнению с классическим «вырезанием вокала» через подавление фазы или настольным разделителем стемов онлайн-сервис не требует ни установки, ни собственного GPU, разделение с помощью ИИ сохраняет хвосты реверберации и гармонии, которые трюк с центральным каналом стёр бы, а в результате вы получаете полноценную караоке-студию, а не папку с файлами.

Караоке-студия в вашем браузере

Студия показывает каждый стем как дорожку: горизонтальные ряды с волновой формой, по которой можно кликнуть, чтобы перейти к нужному месту, или классические вертикальные канальные линейки, как на микшерном пульте. У каждой дорожки есть поворотные регуляторы громкости и панорамы, кнопки отключения звука и соло, стереоиндикаторы уровня и собственная стойка эффектов — срез НЧ, трёхполосный EQ, компрессор, теплота, транспонирование, удвоение, флэнджер, эхо, реверберация и лимитер — с пресетами в одно касание, например «Лоск», «Тёплый», «Воздух», «Зал», «Радио» и «Слэпбэк».

Запись встроена: нажмите «Запись» — после отсчёта в три доли вступает аккомпанемент, и ваш голос записывается без обработки поверх стемов. Каждый дубль может стать отдельной дорожкой — Дубль 1, Дубль 2 и так далее, — и каждому можно дать название (до 10 символов) прямо во время пения, чтобы всегда знать, какой дубль какой. Можно также загрузить дубль, записанный в другом месте. При скачивании рендерится ровно то, что вы слышите: одна дорожка, весь микс или ZIP со всеми дорожками — с эффектами или без.

Синхронизированный текст на 16 языках

Включите «Синхронизированный текст» перед обработкой или добавьте его позже прямо в студии — заново распознаётся только отделённый вокал, песня повторно не обрабатывается. Слова распознаются из выделенного голоса, и каждое синхронизируется с музыкой, поэтому караоке-экран подсвечивает их в тот момент, когда они звучат.

Пословная синхронизация доступна на 16 языках; песни на всех остальных языках тоже получают текст — с синхронизацией по строкам. Письменности с направлением справа налево, например арабская и персидская, отображаются в правильном порядке.

  • Пословная синхронизация: английский, арабский, венгерский, греческий, испанский, итальянский, китайский, немецкий, нидерландский, персидский, польский, португальский, русский, финский, французский и японский
  • Четыре стиля экрана — «Прожектор», «Поток», «Караоке-строка» и «Список» — со шрифтами, цветами, свечением и фонами, а также полноэкранный режим для телевизора
  • Меняйте слова или время любой строки и в любой момент возвращайтесь к оригиналу
  • Скачивайте текст в виде LRC (с синхронизацией по строкам или по словам), SRT, WebVTT, простого текста или JSON

Клонирование голоса с ИИ: песня вашим собственным голосом

Функция «Добавить дорожку с вашим голосом» заново исполняет основной вокал песни вашим голосом. Запишите или загрузите 10–30 секунд своего пения или речи, подтвердите, что это ваш собственный голос, — и модель преобразования певческого голоса перепоёт отделённый вокал вашим голосом, сохранив оригинальные мелодию, ритм и слова. Новая дорожка появляется рядом с оригиналом: оригинальный вокал приглушается, чтобы вы слышали себя, а одно нажатие на M возвращает его для сравнения.

Доступны два движка клонирования голоса: более быстрый Seed-VC и SoulX-Singer, который очень точно держит мелодию и работает примерно вдвое дольше. Вы выбираете октаву (только целые октавы, чтобы голос оставался в тональности песни) и число шагов диффузии — больше шагов дают больше деталей и занимают пропорционально больше времени. Каждый клон становится новой дорожкой — до восьми голосовых дорожек на песню, так что движки можно сравнить бок о бок.

  • Песни на любом языке: преобразование меняет голос и сохраняет слова, которые спел оригинальный исполнитель
  • От полуминуты до минуты на четырёхминутную песню
  • Ваш образец голоса хранится только в вашем аккаунте, используется лишь для создания ваших голосовых дорожек и может быть удалён в любой момент
  • Лучше всего работает с чистым сольным вокалом; гармонии и подпевки размываются, а слова звучат чуть мягче, чем в оригинале

Вопросы, которые задают музыканты

Насколько качественное разделение?

На хорошо спродюсированных поп-, рок- и хип-хоп-треках инструментал получается достаточно чистым для караоке и живых выступлений. Записи с сильной реверберацией, концертные бутлеги и песни, где голос продублирован синтезатором, могут оставлять слабые следы. Движки «Высокое качество» и «Ультра» заметно уменьшают эти артефакты.

Какие форматы файлов можно загружать?

Файлы MP3, WAV и M4A, а также ссылки с YouTube, SoundCloud, Facebook и TikTok. Готовые стемы — MP3 с битрейтом 128 kbps на движке «Стандартный» и 320 kbps на «Высокое качество» и «Ультра».

Что такое стем?

Стем — это одна группа инструментов, экспортированная отдельным аудиофайлом: вокал, ударные, бас, пианино, гитара и «другое» — для синтезаторов и всего остального. Режим двух стемов даёт только голос и инструментал.

Какие языки поддерживает синхронизированный текст?

Пословная синхронизация на 16 языках: английский, арабский, венгерский, греческий, испанский, итальянский, китайский, немецкий, нидерландский, персидский, польский, португальский, русский, финский, французский и японский. Песни на любом другом языке тоже получают текст с синхронизацией по строкам, поэтому подсвечивается именно та строка, которая сейчас звучит.

Какие языки поддерживает клонирование голоса?

Любые. Клонирование певческого голоса меняет только голос: мелодия, ритм и слова берутся у оригинального исполнителя, поэтому песня на арабском, английском или японском перепевается вашим голосом на том же языке. Два движка обучались на разных данных — SoulX-Singer на пении на мандаринском, английском и кантонском, Seed-VC — с многоязычным речевым энкодером, — так что если слова какой-то песни звучат неразборчиво, попробуйте другой движок.

Остаётся ли мой образец голоса конфиденциальным?

Да. Образец сохраняется в вашем аккаунте только после того, как вы подтвердите, что это ваш собственный голос или что у вас есть разрешение его обладателя. Он используется только для создания ваших голосовых дорожек, и вы можете заменить или удалить его в любой момент. Копия, отправленная на GPU для задачи, удаляется вместе с этой задачей.

Сколько дублей можно записать?

Сколько угодно, один за другим. Если включена опция «Каждый дубль — отдельная дорожка», каждый дубль становится отдельной дорожкой, которую можно назвать, свести и скачать; в песне может быть до восьми голосовых дорожек (дубли и клоны голоса вместе). Если выключить эту опцию, дубли будут накладываться на одну дорожку «Вы».

Можно ли использовать результат в коммерческих целях?

Само разделение принадлежит вам, но авторские права на исходную запись сохраняются. Караоке дома, занятия и частное изучение — без проблем; выпуск ремикса или публичное исполнение требуют лицензии от правообладателя. Клон голоса можно создавать только из собственного голоса или с разрешения его обладателя.

Почему моя песня слишком длинная?

У каждого движка есть ограничение длительности трека за один запуск, которое зависит от вашего тарифа; точные минуты указаны выше в разделе «Бесплатно vs Pro» и в самом инструменте. Ограничение защищает общую очередь, чтобы результаты оставались быстрыми для всех.

Работает ли это на телефоне?

Да. Обработка происходит на наших серверах, поэтому странице нужен только браузер. Караоке-экран, запись и микшер работают с сенсорным управлением, а скачанные файлы попадают в приложение «Файлы» на телефоне.

Узнать больше