Créez facilement des pistes karaoké : séparez n'importe quelle chanson (YouTube, liens sociaux ou MP3/WAV) en 6 pistes maximum, chantez avec les paroles synchronisées, enregistrez vos propres prises et écoutez le morceau avec votre propre voix grâce au clonage de voix par IA. Une isolation vocale rapide et très précise, avec une IA de pointe.
Le vocal remover décompose un mixage terminé en ses différentes parties. Donnez-lui un morceau depuis YouTube, SoundCloud, TikTok ou Facebook, ou importez un MP3 ou un WAV, et un réseau de neurones entraîné sur des milliers d'enregistrements multipistes détermine quelles composantes du son appartiennent à la voix, à la batterie, à la basse, au piano, à la guitare et aux autres instruments. Vous obtenez chaque partie dans son propre fichier : un instrumental propre pour le karaoké, une acapella pour un remix, ou une piste de batterie seule pour vous entraîner.
Et l'outil ne s'arrête pas à la séparation. Le résultat s'ouvre dans un studio karaoké : les paroles s'illuminent mot à mot pendant la lecture, vous pouvez enregistrer vos propres prises sur le groupe, et le clonage de voix par IA vous rechante le morceau avec votre propre voix. Tout s'exécute sur les serveurs de Mazmazika — les moteurs Ultra et Haute qualité sur des GPU — cela fonctionne donc aussi bien sur un téléphone que sur un ordinateur portable, sans rien installer.
Lu en direct depuis les réglages actuels des formules, pour que cette section corresponde toujours à ce que l'outil applique aujourd'hui.
Voir les formules et les prix actuels
Comparé à un « vocal cut » classique par annulation de phase ou à un séparateur de pistes sur ordinateur, le remover en ligne ne demande ni installation ni GPU personnel, la séparation par IA conserve les queues de réverbération et les harmonies qu'une astuce de canal central effacerait, et le résultat est un studio karaoké complet plutôt qu'un dossier de fichiers.
Le studio présente chaque piste séparée comme une piste de mixage : des lignes horizontales avec une forme d'onde sur laquelle cliquer pour vous déplacer, ou des tranches de console verticales classiques. Chaque piste dispose de potentiomètres rotatifs de volume et de panoramique, des boutons muet et solo, de vumètres stéréo et de son propre rack d'effets — coupe-bas, EQ trois bandes, compresseur, chaleur, transposition, doublage, flanger, écho, réverb et limiteur — avec des presets en un geste comme Finition, Chaud, Aérien, Salle, Radio et Slapback.
L'enregistrement est intégré : appuyez sur Enregistrer, un décompte de trois temps lance le groupe, puis votre voix est enregistrée sans effets par-dessus les pistes. Chaque prise peut devenir une piste à part entière — Prise 1, Prise 2, etc. — et vous pouvez nommer chacune (jusqu'à 10 caractères) pendant que vous chantez, pour toujours savoir quelle prise est laquelle. Vous pouvez aussi importer une prise enregistrée ailleurs. Les téléchargements restituent exactement ce que vous entendez : une piste, le mix complet ou un ZIP de toutes les pistes, avec ou sans les effets.
Activez « Paroles synchronisées » avant le traitement, ou ajoutez-les plus tard depuis le studio — seule la voix séparée est relue, le morceau n'est pas traité une seconde fois. Les paroles sont transcrites à partir de la voix isolée et chaque mot est calé sur la musique, pour que l'écran karaoké les illumine au moment où ils sont chantés.
La synchronisation mot à mot est disponible en 16 langues ; les morceaux dans toutes les autres langues ont quand même leurs paroles, synchronisées ligne par ligne. Les écritures de droite à gauche, comme l'arabe et le persan, s'affichent dans le bon ordre.
« Ajouter une piste avec votre voix » rechante la voix principale du morceau avec votre voix. Enregistrez ou importez 10 à 30 secondes de vous en train de chanter ou de parler, confirmez qu'il s'agit bien de votre voix, et un modèle de conversion de voix chantée rechante la voix séparée avec votre voix tout en conservant la mélodie, le rythme et les paroles d'origine. La nouvelle piste arrive à côté de l'original : la voix principale d'origine est coupée pour que vous vous entendiez, et un appui sur M la rétablit pour comparer.
Deux moteurs de clonage de voix sont disponibles : Seed-VC, le plus rapide, et SoulX-Singer, qui suit la mélodie de très près et prend environ deux fois plus de temps. Vous choisissez l'octave (uniquement par octaves entières, pour que votre voix reste dans la tonalité du groupe) et le nombre d'étapes de diffusion — plus d'étapes apportent plus de détails et prennent proportionnellement plus de temps. Chaque clone devient une nouvelle piste, jusqu'à huit pistes vocales par morceau, pour comparer les moteurs côte à côte.
Sur de la pop, du rock et du hip-hop bien produits, l'instrumental est assez propre pour le karaoké et la scène. Les enregistrements très réverbérés, les bootlegs live et les morceaux où la voix est doublée par un synthé peuvent laisser de légères traces. Les moteurs Haute qualité et Ultra réduisent nettement ces artefacts.
Des fichiers MP3, WAV et M4A, plus des liens YouTube, SoundCloud, Facebook et TikTok. Les pistes produites sont des MP3 à 128 kbps avec le moteur Standard et à 320 kbps avec Haute qualité et Ultra.
Un stem — une piste séparée — est un groupe d'instruments exporté dans son propre fichier audio : voix, batterie, basse, piano, guitare, et « autres » pour les synthés et tout le reste. Le mode 2 pistes vous donne uniquement la voix et l'instrumental.
La synchronisation mot à mot en 16 langues : allemand, anglais, arabe, chinois, espagnol, finnois, français, grec, hongrois, italien, japonais, néerlandais, persan, polonais, portugais et russe. Les morceaux dans toute autre langue ont quand même leurs paroles, synchronisées ligne par ligne, pour que la bonne ligne s'illumine pendant qu'elle est chantée.
Toutes. Le clonage de voix chantée ne change que la voix : la mélodie, le rythme et les paroles viennent du chanteur original, donc un morceau en arabe, en anglais ou en japonais est rechanté avec votre voix dans la même langue. Les deux moteurs ont appris sur des données différentes — SoulX-Singer sur du chant en mandarin, en anglais et en cantonais, Seed-VC avec un encodeur de parole multilingue — donc si les paroles d'un morceau ressortent peu distinctes, essayez l'autre moteur.
Oui. L'échantillon n'est enregistré dans votre compte qu'après que vous avez confirmé qu'il s'agit de votre propre voix ou que vous avez l'autorisation de la personne enregistrée. Il sert uniquement à créer vos pistes vocales, et vous pouvez le remplacer ou le supprimer à tout moment. La copie envoyée au GPU pour une tâche est supprimée avec cette tâche.
Autant que vous voulez, l'une après l'autre. Avec l'option « Une piste par prise » activée, chaque prise est une piste distincte que vous pouvez nommer, mixer et télécharger ; un morceau peut contenir jusqu'à huit pistes vocales (prises et clones de voix confondus). Désactivez l'option et vos prises s'additionnent plutôt sur une seule piste « Vous ».
La séparation elle-même vous appartient, mais l'enregistrement d'origine reste protégé par le droit d'auteur. Le karaoké à la maison, l'entraînement et l'étude privée ne posent aucun problème ; publier un remix ou se produire en public exige une licence du titulaire des droits. Un clone de voix ne peut être créé qu'à partir de votre propre voix, ou avec l'autorisation de la personne enregistrée.
Chaque moteur a une durée maximale de morceau par traitement, qui dépend de votre formule ; les minutes exactes figurent ci-dessus sous « Gratuit vs Pro » et dans l'outil lui-même. Cette limite protège la file d'attente partagée pour que les résultats restent rapides pour tout le monde.
Oui. Le traitement a lieu sur nos serveurs, la page n'a donc besoin que d'un navigateur. L'écran karaoké, l'enregistrement et le mixeur fonctionnent tous au toucher, et les téléchargements arrivent dans l'application Fichiers de votre téléphone.