AI-vokalfjerner og stem-splitter

Mazmazika Sang-stemmeseparator

Lav nemt karaokenumre: del enhver sang (YouTube, sociale links eller MP3/WAV) op i op til 6 spor, syng med på synkroniseret sangtekst, optag dine egne takes, og hør sangen sunget med din egen stemme takket være AI-stemmekloning. Hurtig og yderst præcis vokalisolering med topmoderne AI.

Om Mazmazikas vocal remover og karaokestudie

Vocal removeren skiller et færdigt mix ad i dets enkelte dele igen. Giv den en sang fra YouTube, SoundCloud, TikTok eller Facebook, eller upload en MP3 eller WAV, og et neuralt netværk trænet på tusindvis af multitrack-indspilninger forudsiger, hvilke dele af lyden der hører til stemmen, trommerne, bassen, klaveret, guitaren og de øvrige instrumenter. Du får hver del som sin egen fil: en ren instrumental til karaoke, en acapella til et remix eller et rent trommespor til øvning.

Og det stopper ikke ved adskillelsen. Resultatet åbner i et karaokestudie: sangteksten lyser op ord for ord, mens sangen spiller, du kan optage dine egne takes over bandet, og AI-stemmekloning synger sangen tilbage med din egen stemme. Alt kører på Mazmazikas servere — motorerne Ultra og Høj kvalitet på GPU'er — så det virker lige så godt på en telefon som på en laptop, uden at du skal installere noget.

Sådan virker det

  1. Indsæt et link, eller upload en fil. Lyden hentes og dekodes på serveren.
  2. Vælg motor og antal spor. Ultra deler op i 2, 4 eller 6 spor (stemme, trommer, bas, klaver, guitar og resten); Høj kvalitet giver det reneste par af stemme og instrumental; Standard giver op til fem spor. Ultra og Høj kvalitet leverer MP3 i 320 kbps.
  3. Slå Synkroniseret sangtekst til, hvis du vil have ordene med, og start så behandlingen. En typisk sang på fire minutter er klar på under et minut med Ultra.
  4. Studiet åbner: hvert spor får sin egen lydstyrke, panorering, lydløs- og soloknap og effekter, og karaokeskærmen viser sangteksten.
  5. Optag dine takes, tilføj et spor med din stemme, og download enkelte spor, hele mixet eller alt på én gang — med eller uden effekterne. Et gemt projekt åbner igen præcis, som du forlod det.

Hvad musikere bruger det til

  • Karaokeaftener: fjern leadvokalen, behold bandet i fuld kvalitet, og syng med teksten på skærmen.
  • Sangøvelse: optag take efter take over originalen, sammenlign dem spor for spor, og behold det bedste.
  • Hør med AI-stemmekloning, hvordan en sang ville lyde med din egen stemme, før du lærer den.
  • Acapellaer til remixes, mashups og DJ-sets.
  • Øvespor: gør dit eget instruments spor lydløst, og spil med resten af bandet.
  • Transskription og studier: isolér bassen, klaveret eller guitaren for at høre partiet tydeligt.
  • Sangundervisning: sammenlign en sangers take med den isolerede original.

Gratis vs. Pro

Læses live fra de aktuelle abonnementsindstillinger, så dette afsnit altid svarer til det, værktøjet håndhæver i dag.

Se abonnementerne og de aktuelle priser

Sammenlignet med et klassisk »vocal cut« med faseophævning eller en stem-splitter til desktop kræver online-removeren ingen installation og ingen egen GPU, AI-adskillelsen bevarer de rumklangshaler og harmonier, som et center-kanal-trick ville slette, og resultatet er et komplet karaokestudie i stedet for en mappe med filer.

Et karaokestudie i din browser

Studiet viser hvert spor som en mixerkanal: vandrette rækker med en bølgeform, du kan klikke på for at hoppe, eller klassiske lodrette kanalstrips. Hvert spor har drejeknapper til lydstyrke og panorering, lydløs- og soloknapper, niveaumålere i stereo og sit eget effektrack — low cut, trebånds-EQ, kompressor, varme, transponering, fordobling, flanger, ekko, rumklang og limiter — med presets med ét tryk som Poleret, Varm, Luftig, Sal, Radio og Slapback.

Optagelse er indbygget: tryk på Optag, så starter bandet efter en indtælling på tre slag, og din stemme optages rent over sporene. Hvert take kan blive sit eget spor — Take 1, Take 2 og så videre — og du kan navngive hvert enkelt (op til 10 tegn), mens du synger, så du altid ved, hvilket take der er hvilket. Du kan også uploade et take, du har optaget et andet sted. Downloads renderer præcis det, du hører: ét spor, hele mixet eller en ZIP med alle spor, med eller uden effekterne.

Synkroniseret sangtekst på 16 sprog

Slå Synkroniseret sangtekst til før behandlingen, eller tilføj den senere inde fra studiet — så læses kun den adskilte vokal igen, og sangen behandles ikke en gang til. Ordene transskriberes fra den isolerede stemme, og hvert ord synkroniseres med musikken, så karaokeskærmen lyser dem op, mens de synges.

Ord-for-ord-timing findes på 16 sprog; sange på alle andre sprog får stadig deres sangtekst, timet linje for linje. Skriftsystemer, der læses fra højre mod venstre, som arabisk og persisk, vises i den rigtige rækkefølge.

  • Ord-for-ord-timing: arabisk, engelsk, finsk, fransk, græsk, italiensk, japansk, kinesisk, nederlandsk, persisk, polsk, portugisisk, russisk, spansk, tysk og ungarsk
  • Fire skærmstile — Spotlight, Flydende, Karaokebjælke og Liste — med skrifttyper, farver, glød og baggrunde og en fuldskærmstilstand til tv'et
  • Rediger ordene eller timingen i enhver linje, og vend tilbage til originalen når som helst
  • Download sangteksten som LRC (timet pr. linje eller pr. ord), SRT, WebVTT, ren tekst eller JSON

AI-stemmekloning: sangen med din egen stemme

»Tilføj et spor med din stemme« synger sangens leadvokal igen med din stemme. Optag eller upload 10 til 30 sekunder, hvor du synger eller taler, bekræft, at det er din egen stemme, og en model til singing voice conversion synger den adskilte vokal igen med din stemme og bevarer den originale melodi, timing og tekst. Det nye spor kommer ved siden af originalen: den originale leadvokal gøres lydløs, så du hører dig selv, og ét tryk på M henter den tilbage, så du kan sammenligne.

Der er to motorer til stemmekloning: Seed-VC, den hurtigste, og SoulX-Singer, som holder melodien meget tæt og tager cirka dobbelt så lang tid. Du vælger oktaven (kun hele oktaver, så din stemme bliver i samme toneart som bandet) og antallet af diffusionstrin — flere trin giver flere detaljer og tager tilsvarende længere tid. Hver klon bliver et nyt spor, op til otte stemmespor pr. sang, så du kan sammenligne motorerne side om side.

  • Sange på alle sprog: konverteringen ændrer stemmen og beholder de ord, den oprindelige sanger sang
  • Cirka et halvt til et helt minut for en sang på fire minutter
  • Din stemmeprøve forbliver privat på din konto, bruges kun til at lave dine stemmespor og kan slettes når som helst
  • Virker bedst på en klar leadvokal; harmonier og kor flyder sammen, og ordene bliver lidt blødere end i originalen

Spørgsmål musikere stiller

Hvor god er adskillelsen?

På velproduceret pop, rock og hiphop er instrumentalen ren nok til karaoke og livebrug. Meget rumklangsfyldte optagelser, live-bootlegs og sange, hvor stemmen dobles af en synth, kan efterlade svage rester. Motorerne Høj kvalitet og Ultra reducerer disse artefakter mærkbart.

Hvilke filformater kan jeg uploade?

MP3-, WAV- og M4A-filer samt links fra YouTube, SoundCloud, Facebook og TikTok. Sporene leveres som MP3 i 128 kbps med Standard-motoren og 320 kbps med Høj kvalitet og Ultra.

Hvad er et spor (stem)?

Et spor (på engelsk »stem«) er én gruppe instrumenter, der eksporteres som sin egen lydfil: vokal, trommer, bas, klaver, guitar og »andre« til synths og alt det resterende. Tilstanden med 2 spor giver dig kun stemme og instrumental.

Hvilke sprog understøtter den synkroniserede sangtekst?

Ord-for-ord-timing på 16 sprog: arabisk, engelsk, finsk, fransk, græsk, italiensk, japansk, kinesisk, nederlandsk, persisk, polsk, portugisisk, russisk, spansk, tysk og ungarsk. Sange på alle andre sprog får stadig deres sangtekst, timet linje for linje, så den rigtige linje lyser op, mens den synges.

Hvilke sprog understøtter stemmekloningen?

Alle. Stemmekloning til sang ændrer kun stemmen: melodien, timingen og ordene kommer fra den oprindelige sanger, så en sang på arabisk, engelsk eller japansk synges igen med din stemme på samme sprog. De to motorer har lært af forskellige data — SoulX-Singer af sang på mandarin, engelsk og kantonesisk, Seed-VC med en flersproget taleencoder — så hvis ordene i en sang bliver utydelige, så prøv den anden motor.

Er min stemmeprøve privat?

Ja. Stemmeprøven gemmes først på din konto, når du har bekræftet, at det er din egen stemme, eller at du har tilladelse fra den, der taler. Den bruges kun til at lave dine stemmespor, og du kan erstatte eller slette den når som helst. Kopien, der sendes til GPU'en til et job, slettes sammen med jobbet.

Hvor mange takes kan jeg optage?

Så mange du vil, det ene efter det andet. Med »Hvert take bliver sit eget spor« slået til er hvert take et separat spor, som du kan navngive, mixe og downloade; en sang kan rumme op til otte stemmespor (takes og stemmekloner tilsammen). Slår du indstillingen fra, lægges dine takes i stedet sammen på ét enkelt spor, »Dig«.

Må jeg bruge resultatet kommercielt?

Selve adskillelsen er din, men den underliggende indspilning beholder sin ophavsret. Karaoke hjemme, øvning og privat studie er fint; at udgive et remix eller optræde offentligt kræver en licens fra rettighedshaveren. En stemmeklon må kun laves af din egen stemme eller med tilladelse fra den, der taler.

Hvorfor er min sang for lang?

Hver motor har en maksimal sanglængde pr. kørsel, som afhænger af din plan; de præcise minutter står under Gratis vs. Pro ovenfor og i selve værktøjet. Grænsen beskytter den fælles kø, så resultaterne forbliver hurtige for alle.

Virker det på en telefon?

Ja. Behandlingen sker på vores servere, så siden kræver kun en browser. Karaokeskærmen, optagelsen og mixeren fungerer alle med touch, og downloads lander i din telefons filapp.

Læs mere