En bref
Si de la musique passe derrière une voix — une enceinte dans un café, une chanson sous une vidéo de téléphone, un morceau resté allumé pendant une prise de podcast —, vous n'avez pas besoin de la session d'origine pour récupérer la voix. Envoyez le fichier dans retirez la musique de fond (le même moteur fait tourner sortez la voix de la musique et le suppresseur de voix), et la séparation par IA renvoie deux pistes : la voix seule et la musique seule. Elle accepte un MP3, un WAV, un M4A ou l'audio d'un MP4, jusqu'à 10 Mo ; une séparation coûte 10 crédits et se termine généralement en une à trois minutes. Chargez ensuite la voix dans l'égaliseur audio gratuit, appliquez le préréglage Podcast ou Voix, et exportez en MP3 ou en WAV. Une limite honnête : la séparation retire la musique. Ce n'est pas un réducteur de bruit pour le souffle, le vent ou la circulation.
Dans ce guide
- Ce que la séparation peut et ne peut pas faire
- Avant de commencer
- Étape 1 Séparer la voix de la musique
- Étape 2 Peaufiner la voix avec un égaliseur
- Quel préréglage pour quel enregistrement
- Dépannage
- Situations réelles que cela règle
- Questions fréquentes
- Le mot de la fin
Ce que la séparation peut et ne peut pas faire
Les anciennes astuces d'« isolation de la voix » fonctionnaient par annulation de phase : elles soustrayaient le canal gauche du droit en espérant que la voix soit au centre. Elles détruisaient la voix aussi souvent qu'elles retiraient la musique. La séparation moderne est différente. Un réseau de neurones entraîné sur des milliers de voix et d'instrumentaux isolés écoute tout le mix et reconstruit deux nouveaux fichiers — l'un avec la voix seule, l'autre avec tout le reste. Comme il modélise à quoi ressemble une voix plutôt que l'endroit où elle se trouve dans l'image stéréo, il fonctionne aussi sur des enregistrements mono de téléphone.
Ce qu'il fait bien :
- La musique sous la parole. Une chanson en fond d'un vlog, une enceinte de café sous un mémo vocal, un DJ set qui déborde dans une interview.
- Le chant sur un accompagnement. Une vidéo de répétition dont vous voulez le chanteur seul.
- Garder les deux moitiés. Vous recevez aussi la musique comme piste séparée, pratique si vous voulez la remplacer par quelque chose dont vous avez les droits.
Ce qu'il n'est pas :
- Un réducteur de bruit. Le souffle, le ronflement, le vent, la circulation et l'écho de la pièce ne sont pas de la musique, et le modèle n'essaie pas de les retirer. C'est pour cela que la page sortez la voix de la musique le dit clairement.
- Un miracle sur une voix enfouie. Si la musique est beaucoup plus forte que la personne qui parle, la voix séparée sera utilisable mais plus fine. Plus la voix était forte dans l'original, plus le résultat est propre.
Avant de commencer
- Format et taille. MP3, WAV, M4A, ou une vidéo MP4 (l'audio en est extrait), jusqu'à 10 Mo. Un MP3 de 10 Mo à 128 kbps représente environ dix minutes ; si votre fichier est plus gros, découpez d'abord la partie dont vous avez besoin.
- Un compte et des crédits. La séparation tourne sur nos serveurs, il faut donc être connecté. Chaque passage coûte 10 crédits ; les nouveaux comptes démarrent avec 16 crédits gratuits, de quoi faire une séparation. D'autres crédits viennent avec n'importe quelle formule ou pack de crédits.
- Votre fichier n'est pas conservé. Le fichier envoyé sert à cette seule séparation et est supprimé une fois le travail terminé.
- Les droits. Séparer un enregistrement ne change pas son propriétaire. Les pistes issues de vos propres enregistrements sont à vous ; celles extraites de la chanson commerciale de quelqu'un d'autre sont pour un usage privé.
Étape 1 Séparer la voix de la musique
- Ouvrez retirez la musique de fond. La page s'ouvre sur Importer un fichier ; l'autre onglet, Depuis ma bibliothèque, sert aux chansons que vous avez générées sur le site.
- Cliquez dans la zone en pointillés et choisissez votre enregistrement. Le nom du fichier apparaît dans la zone.

- Appuyez sur Enlever la voix (10 crédits). Si vous n'êtes pas connecté, une fenêtre de connexion s'ouvre d'abord ; rien n'est débité tant que le travail n'a pas réellement démarré.
- Le travail tourne en arrière-plan — généralement une à trois minutes selon la durée — et vous pouvez quitter la page. Il apparaît dans la liste des tâches à droite.
- Une fois terminé, vous avez deux fichiers : la voix isolée (l'a cappella) et la musique sans la voix (l'instrumental). Écoutez les deux, puis téléchargez la voix.
Le bouton dit « Enlever la voix » parce que le même outil sert aussi dans l'autre sens — retirer le chanteur d'une chanson pour un karaoké. Pour un enregistrement vocal, le fichier qu'il vous faut est celui de la voix. Si une séparation échoue, les crédits sont remboursés automatiquement.
Étape 2 Peaufiner la voix avec un égaliseur
Une voix séparée est souvent un peu terne ou boueuse : le modèle a retiré la musique mais gardé chaque grondement grave capté par le micro. Deux minutes avec un égaliseur règlent l'essentiel.
- Ouvrez l'égaliseur audio et cliquez sur Choisir un fichier audio pour charger la voix séparée.
- Choisissez un préréglage. Pour la parole, commencez par Podcast : il coupe fort les bandes les plus graves (−8 dB à 31 Hz, −6 à 62 Hz), laisse le médium tranquille et relève de 3 dB la zone de présence autour de 1–2 kHz, là où vivent les consonnes et l'intelligibilité.
- Appuyez sur Lire et écoutez en ajustant les curseurs un par un. Chacune des dix bandes — 31, 62, 125, 250, 500 Hz et 1, 2, 4, 8, 16 kHz — bouge de ±12 dB, et vous entendez la modification pendant que vous faites glisser.
- Exportez avec Télécharger le MP3 ou Télécharger le WAV. L'export passe par la même chaîne de filtres que l'écoute, le fichier sonne donc exactement comme ce que vous avez entendu.

Quand nous avons exporté notre fichier de test en WAV, il est revenu en fichier complet de 41 Mo avec le suffixe -eq dans le nom, prêt pour un éditeur. L'égaliseur n'envoie jamais rien — le fichier est traité dans votre navigateur — et il est gratuit, sans compte.
Quel préréglage pour quel enregistrement
Les cinq préréglages sont des points de départ, pas des verdicts :
| Enregistrement | Commencez par | Puis essayez |
|---|---|---|
| Mémo vocal parlé, interview, podcast | Podcast | Baissez encore les 16 kHz s'il y a du souffle |
| Chant, rap, voix off qui recevra de la musique | Voix | Ajoutez +1 ou +2 à 4 kHz pour plus d'air |
| Voix étouffée ou lointaine | Brillant | Coupez 250 Hz de 2–3 dB pour retirer l'effet boîte |
| Enregistrement de téléphone maigre | Plat, puis +2 à 125–250 Hz | Gardez 31–62 Hz coupés pour éviter le grondement |
| Tout ce que vous avez trop traité | Réinitialiser | Repartez de Plat |
Une règle aide plus que n'importe quel préréglage : couper avant de booster. Booster toutes les bandes, c'est juste monter tout le fichier jusqu'à la saturation. Retirer ce qui gêne — le grondement en bas, l'effet boîte autour de 250–500 Hz — fait généralement plus pour l'intelligibilité qu'ajouter des aigus.
Dépannage
« Ce fichier dépasse 10 Mo. » Découpez la partie dont vous avez besoin, ou exportez-la à un débit plus faible. Un MP3 à 96 kbps suffit pour la parole et tient environ 14 minutes dans 10 Mo.
La voix a des artefacts aqueux, tourbillonnants. Cela arrive là où musique et voix se disputaient les mêmes fréquences à un volume proche. Essayez de séparer une copie qui commence et finit sur la parole seule, pour que le modèle entende moins de musique au total. Une légère coupe vers 4–8 kHz dans l'égaliseur adoucit aussi les artefacts.
La musique a disparu mais il reste du souffle ou de la circulation. La séparation retire la musique, pas le bruit. Servez-vous de l'égaliseur pour adoucir les extrêmes (coupe-bas pour le grondement, petite coupe à 8–16 kHz pour le souffle), et pour un bruit important, utilisez un outil dédié à la réduction de bruit.
L'égaliseur dit que le fichier n'a pas pu être décodé. Utilisez du MP3, du WAV ou du M4A. Certains codecs inhabituels dans des fichiers vidéo ne sont pas décodables par le navigateur ; convertissez d'abord en MP3.
L'export a échoué. Les fichiers très longs peuvent épuiser la mémoire du navigateur. Coupez l'enregistrement en parties plus courtes et exportez-les une par une.
Situations réelles que cela règle
- Le mémo vocal du café. Vous avez enregistré une idée de chanson sur votre téléphone et l'enceinte du café passait un tube pop. Séparez, gardez la voix et utilisez-la comme voix témoin.
- La vidéo du discours. Un toast de mariage filmé pendant que le groupe jouait. La voix séparée, passée dans le préréglage Podcast, est assez claire pour un montage des meilleurs moments.
- La prise de podcast avec de la musique qui déborde. Quelqu'un a laissé tourner une playlist pendant une interview. La séparation sauve la prise sans réenregistrer.
- Remplacer une musique protégée dans un vlog. Séparez, gardez la voix et placez dessous un morceau qui vous appartient — par exemple un que vous générez vous-même avec le générateur de musique IA. Notre guide sur la musique IA pour YouTube explique ce que signalent les plateformes.
- Chanter sur un fond de karaoké. Gardez la voix pour une reprise, ou l'instrumental pour vous entraîner. Si le karaoké est le but, le guide de la version karaoké suit cette direction.
Questions fréquentes
Retirer la musique de fond d'un enregistrement vocal est-il gratuit ?
L'étape de l'égaliseur est gratuite, sans compte. L'étape de séparation utilise l'IA sur nos serveurs et coûte 10 crédits par passage ; les nouveaux comptes reçoivent 16 crédits gratuits, de quoi faire une séparation.
Quels fichiers puis-je envoyer ?
MP3, WAV, M4A, ou une vidéo MP4 (la piste audio est utilisée), jusqu'à 10 Mo par fichier.
Est-ce que je récupère aussi la musique ?
Oui. Chaque séparation renvoie deux fichiers : la voix isolée et la musique sans la voix. Les deux peuvent être écoutés et téléchargés depuis la liste des tâches.
Retire-t-il le vent, le souffle ou le bruit de la circulation ?
Non. La séparation est faite pour dissocier la voix de la musique. Elle ne vise pas le bruit, et la page dédiée à la voix le dit. Un égaliseur peut adoucir souffle et grondement ; un bruit important demande un outil de réduction de bruit.
Combien de temps ça prend ?
La plupart des enregistrements sont prêts en une à trois minutes, selon leur durée. Le travail tourne en arrière-plan, vous pouvez donc quitter la page et revenir.
Mon enregistrement est-il conservé ?
Le fichier envoyé ne sert qu'à cette séparation et est supprimé une fois le travail terminé. L'égaliseur, lui, n'envoie rien du tout.
Puis-je utiliser commercialement la voix nettoyée ?
Si c'est votre propre enregistrement, oui. Séparer un enregistrement ne change pas sa propriété, donc les pistes extraites de la chanson commerciale de quelqu'un d'autre restent pour un usage privé.
Le mot de la fin
Un bon enregistrement vocal gâché par de la musique de fond est l'un des problèmes audio les plus réparables qui soient. Séparez-le avec retirez la musique de fond pour obtenir la voix et la musique en deux fichiers, puis passez deux minutes dans l'égaliseur audio avec le préréglage Podcast ou Voix, et exportez. Gardez des attentes honnêtes — il retire la musique, pas le vent ni le souffle — et la plupart des mémos de café, des discours filmés et des prises de podcast interrompues redeviennent utilisables.
