Skip to main content
Outil gratuit · Rien n’est envoyé

Suppression de voix qui tourne dans votre navigateur

La plupart des suppresseurs de voix envoient votre fichier, le mettent en file d’attente et vous renvoient un lien par e-mail. Celui-ci télécharge le modèle de séparation dans votre navigateur et l’exécute sur place : l’audio ne quitte jamais l’onglet. Vous obtenez un instrumental et un a cappella, tous deux en WAV.

Tourne dans votre navigateur · Sans compte · Jusqu’à 10 minutes par morceau

Écoutez la séparation

Séparateur de stems, instrumental, acapella et karaoké

Les mêmes 15 secondes d’une chanson : le mix d’origine, puis les deux stems que cette page en a tirés.

  • Mix d’origine

    Heartbreak Is a Highway · 15 s

  • Voix seule (acapella)

    Heartbreak Is a Highway · 15 s

  • Instrumental (karaoké)

    Heartbreak Is a Highway · 15 s

Le séparateur

Un fichier entre, deux pistes sortent

Le premier lancement télécharge environ 64 Mo de modèle, que votre navigateur met ensuite en cache. La séparation est un vrai calcul : comptez quelques minutes sur un portable ordinaire, et plus longtemps que la chanson si votre navigateur n’a pas WebGPU.

Ce qui change ici

Le fichier reste chez vous

Ce n’est pas un slogan de confidentialité greffé sur la même architecture que les autres — c’est une architecture différente, avec des conséquences qu’il vaut mieux connaître avant de choisir un outil.

Rien n’est envoyé

Cette page n’a aucun point d’envoi. Votre mixage non sorti, les pistes de votre client et votre mémo vocal sont lus par l’onglet et y restent. Le fermer efface tout.

Les pistes réadditionnées redonnent l’original

Le modèle estime l’instrumental et la voix est ce qui reste : en les additionnant, on reconstitue exactement votre fichier. C’est ce qui fait de l’instrumental un vrai playback karaoké et non une approximation.

C’est votre machine qui travaille

C’est le compromis : pas de file d’attente et pas de coût, mais pas de ferme de serveurs non plus. Les navigateurs WebGPU finissent bien avant la fin du morceau ; sans, vous êtes sur du WebAssembly mono-thread et c’est sensiblement plus long.

Comment ça marche

Des spectrogrammes, pas de la magie

Il vaut la peine de savoir ce que fait l’outil : cela explique l’attente, et cela vous dit quand le résultat sera bon.

  1. 01

    Votre fichier est décodé et rééchantillonné

    En 44,1 kHz stéréo, parce que c’est ce sur quoi le modèle a été entraîné. Un fichier mono est envoyé des deux côtés ; tout ce que le navigateur sait décoder est accepté.

  2. 02

    L’audio devient une image de lui-même

    Des blocs de six secondes deviennent des spectrogrammes — une transformée de 6144 points tous les 1024 échantillons, exactement ce que le modèle attend.

  3. 03

    Le modèle estime l’instrumental

    Bloc par bloc, avec des bords fondus enchaînés pour ne pas entendre une couture toutes les six secondes. C’est la partie qui prend du temps.

  4. 04

    La voix est ce qui reste

    Soustraire l’instrumental estimé de votre original donne la voix, et garantit que les deux moitiés réadditionnées redonnent exactement votre point de départ.

Deux limites honnêtes. La séparation est imparfaite sur les mixages denses — réverbération forte, voix doublées et cymbales fortes sont là où vous entendrez des artefacts, dans les deux pistes. Et un long morceau garde le mixage et les deux pistes en mémoire en même temps, d’où un plafond de 10 minutes plutôt qu’une face d’album.

Crédit

Le modèle n’est pas le nôtre

La séparation utilise UVR-MDX-NET-Inst_HQ_1, entraîné et publié par le projet Ultimate Vocal Remover sous licence MIT, qui demande aux développeurs qui emploient ses modèles de le créditer. L’architecture est MDX-Net, de KUIELab. Nous avons construit la partie navigateur ; le vrai travail, c’est eux.

Questions

Celles qui méritent une réponse

Est-ce gratuit, et y a-t-il une limite ?

Gratuit, sans compte et sans plafond par morceau : c’est votre ordinateur qui travaille, il n’y a donc rien à compter. Seules limites : 10 minutes par morceau et la mémoire de votre machine.

Mon audio est-il envoyé quelque part ?

Non. La page n’a aucun chemin d’envoi : votre navigateur télécharge le modèle et l’exécute en local, l’audio ne quitte jamais l’onglet. La seule requête volumineuse est le modèle lui-même.

Que vais-je obtenir ?

Deux stems, l’instrumental et la voix, en WAV stéréo 44100 Hz. Additionnés, ils redonnent exactement l’original, car la voix est ce qui reste une fois l’instrumental estimé.

Puis-je faire un karaoké ou une acapella ?

Les deux, en une passe : l’instrumental sert de karaoké ou d’accompagnement, la voix d’acapella. Les mix denses laissent des artefacts, écoutez donc les deux avant d’en utiliser un.

Quels fichiers, et quelle durée ?

Tout ce que votre navigateur sait décoder : MP3, WAV, M4A/AAC, FLAC ou OGG, jusqu’à 10 minutes. Le premier essai télécharge une fois environ 64 Mo de modèle ; une séparation prend quelques minutes sur un portable ordinaire.

Puis-je utiliser les stems commercialement ?

Cela dépend de la chanson, pas de l’outil : séparer un enregistrement ne vous donne aucun droit dessus. Vos propres enregistrements sont à vous. Pour une musique que vous pouvez licencier, générez la vôtre.