요약
목소리 뒤에서 음악이 흐르고 있어도 — 카페 스피커, 휴대폰 영상 밑에 깔린 노래, 팟캐스트 녹음 중에 틀어 둔 곡 — 목소리를 되찾는 데 원본 세션은 필요 없습니다. 파일을 배경 음악 제거에 올리면(같은 엔진이 음악에서 목소리 건져내기와 보컬 제거도 돌립니다), AI 분리가 두 개의 트랙 — 목소리만, 그리고 음악만 — 을 돌려줍니다. MP3, WAV, M4A, 또는 MP4 속 오디오를 10 MB까지 받으며, 분리 한 번에 10크레딧이 들고 보통 1~3분이면 끝납니다. 그다음 목소리를 무료 이퀄라이저에 불러와 팟캐스트나 보컬 프리셋을 적용하고 MP3나 WAV로 내보내세요. 솔직한 한계 하나: 분리가 걷어내는 건 음악입니다. 히스, 바람, 차 소리를 위한 노이즈 제거기가 아닙니다.
이 가이드의 내용
- 분리가 할 수 있는 것과 없는 것
- 시작하기 전에
- 1단계 목소리와 음악 분리하기
- 2단계 이퀄라이저로 목소리 다듬기
- 녹음별 프리셋 고르기
- 문제 해결
- 이걸로 해결되는 실제 상황
- 자주 묻는 질문
- 마무리
분리가 할 수 있는 것과 없는 것
예전의 '목소리 분리' 요령은 위상 상쇄를 썼습니다. 왼쪽 채널에서 오른쪽 채널을 빼고 목소리가 가운데 있기를 바라는 방식이라, 음악을 지우는 만큼 목소리도 망가뜨렸습니다. 지금의 분리는 다릅니다. 수천 개의 분리된 보컬과 반주로 학습한 신경망이 믹스 전체를 듣고 새 파일 두 개를 다시 만들어 냅니다. 목소리만 있는 것과 나머지 전부. 목소리가 스테레오의 어디에 있는지가 아니라 목소리가 어떻게 들리는지를 모델링하기 때문에, 휴대폰 모노 녹음에도 통합니다.
잘하는 것:
- 말소리 밑의 음악. 브이로그 배경에 깔린 노래, 음성 메모 밑의 카페 스피커, 인터뷰에 새어 든 DJ 세트.
- 반주 위의 노래. 가수 목소리만 필요한 리허설 영상.
- 두 쪽 모두 갖기. 음악도 별도 트랙으로 받으니, 권리를 가진 곡으로 바꾸고 싶을 때 편리합니다.
못 하는 것:
- 노이즈 제거. 히스, 험, 바람, 차 소리, 방 울림은 음악이 아니라서 모델이 지우려 하지 않습니다. 음악에서 목소리 건져내기 페이지가 그 점을 분명히 밝히는 이유입니다.
- 파묻힌 목소리를 살리는 마법. 음악이 말하는 사람보다 훨씬 크다면 분리된 목소리는 쓸 만하지만 더 얇아집니다. 원본에서 목소리가 클수록 결과가 깨끗합니다.
시작하기 전에
- 형식과 크기. MP3, WAV, M4A, 또는 MP4 영상(오디오를 꺼내 씁니다), 10 MB까지. 128 kbps의 10 MB MP3는 대략 10분입니다. 파일이 더 크면 필요한 부분을 먼저 잘라 내세요.
- 계정과 크레딧. 분리는 저희 서버에서 돌아가므로 로그인이 필요합니다. 한 번에 10크레딧이며, 새 계정은 분리 한 번에 해당하는 무료 크레딧 16개로 시작합니다. 크레딧은 모든 플랜이나 크레딧 팩에 더 포함돼 있습니다.
- 파일은 보관되지 않습니다. 올린 파일은 그 한 번의 분리에만 쓰이고, 작업이 끝나면 삭제됩니다.
- 권리. 녹음을 분리해도 주인이 바뀌지 않습니다. 내 녹음에서 나온 트랙은 내 것이지만, 다른 사람의 상업 음원에서 뽑은 트랙은 개인적 용도로만 쓰세요.
1단계 목소리와 음악 분리하기
- 배경 음악 제거를 엽니다. 파일 업로드 탭으로 열리고, 다른 탭인 내 라이브러리에서는 사이트에서 생성한 노래용입니다.
- 점선 상자를 눌러 녹음을 고릅니다. 상자에 파일 이름이 나타납니다.

- **보컬 제거 (10 크레딧)**를 누릅니다. 로그인하지 않았다면 로그인 창이 먼저 열리고, 작업이 실제로 시작되기 전까지는 아무것도 차감되지 않습니다.
- 작업은 백그라운드에서 돌아가며 — 길이에 따라 보통 1~3분 — 페이지를 떠나도 됩니다. 오른쪽 작업 목록에 나타납니다.
- 끝나면 파일이 두 개 생깁니다. 분리된 목소리(아카펠라)와 목소리가 빠진 음악(반주)입니다. 둘 다 들어 보고 목소리를 내려받으세요.
버튼 이름이 '보컬 제거'인 건, 같은 도구를 반대 방향 — 노래방용으로 곡에서 가수를 빼는 것 — 으로도 쓰기 때문입니다. 음성 녹음이라면 필요한 파일은 보컬 쪽입니다. 분리가 실패하면 크레딧은 자동으로 환불됩니다.
2단계 이퀄라이저로 목소리 다듬기
분리된 목소리는 조금 먹먹하거나 웅웅거리는 경우가 많습니다. 모델이 음악은 지웠지만 마이크가 잡은 저음의 웅웅거림은 모두 남겼기 때문입니다. 이퀄라이저로 2분이면 대부분 해결됩니다.
- 이퀄라이저를 열고 오디오 파일 고르기를 눌러 분리된 목소리를 불러옵니다.
- 프리셋을 고릅니다. 말소리라면 팟캐스트부터 시작하세요. 가장 낮은 대역을 크게 깎고(31 Hz에서 −8 dB, 62 Hz에서 −6), 가운데는 그대로 두고, 자음과 명료도가 사는 1~2 kHz 주변의 존재감 대역을 3 dB 올립니다.
- 재생을 누르고 들으면서 슬라이더를 하나씩 조정합니다. 열 개 대역 — 31, 62, 125, 250, 500 Hz와 1, 2, 4, 8, 16 kHz — 은 각각 ±12 dB 움직이고, 끄는 동안 변화가 들립니다.
- MP3 내려받기나 WAV 내려받기로 내보냅니다. 내보내기는 미리 듣기와 같은 필터를 거치므로, 파일은 들은 그대로 나옵니다.

테스트 파일을 WAV로 내보냈더니, 이름에 -eq가 붙은 전체 길이 41 MB 파일이 나와 편집기에 바로 넣을 수 있었습니다. 이퀄라이저는 아무것도 업로드하지 않고 — 파일은 브라우저에서 처리됩니다 — 무료이며 계정도 필요 없습니다.
녹음별 프리셋 고르기
다섯 프리셋은 출발점이지 정답이 아닙니다.
| 녹음 | 먼저 써 볼 것 | 그다음 시도 |
|---|---|---|
| 말로 한 음성 메모, 인터뷰, 팟캐스트 | 팟캐스트 | 히스가 있으면 16 kHz를 더 내리기 |
| 노래, 랩, 나중에 음악을 깔 내레이션 | 보컬 | 공기감을 원하면 4 kHz를 +1~+2 |
| 먹먹하거나 멀게 들리는 목소리 | 밝게 | 상자 울림을 없애려 250 Hz를 2~3 dB 내리기 |
| 얇은 휴대폰 녹음 | 플랫, 그다음 125~250 Hz를 +2 | 웅웅거림을 막으려 31~62 Hz는 깎은 채로 |
| 과하게 손댄 모든 것 | 초기화 | 플랫에서 다시 시작 |
어떤 프리셋보다 도움이 되는 규칙이 하나 있습니다. 올리기 전에 깎으세요. 모든 대역을 올리는 건 파일 전체를 찌그러질 때까지 키우는 것일 뿐입니다. 거슬리는 것 — 아래쪽 웅웅거림, 250~500 Hz 주변의 상자 울림 — 을 걷어내는 쪽이 고음을 더하는 것보다 대개 명료도에 더 도움이 됩니다.
문제 해결
'파일이 10 MB를 넘습니다.' 필요한 부분을 잘라 내거나 더 낮은 비트레이트로 내보내세요. 말소리라면 96 kbps MP3로 충분하고, 10 MB에 약 14분이 들어갑니다.
목소리에 물 같은, 소용돌이치는 흔적이 있다. 음악과 목소리가 같은 주파수에서 비슷한 음량으로 다투던 곳에서 생깁니다. 말소리로만 시작하고 끝나는 사본을 분리해, 모델이 듣는 음악을 전체적으로 줄여 보세요. 이퀄라이저에서 4~8 kHz를 살짝 깎아도 흔적이 누그러집니다.
음악은 사라졌는데 히스나 차 소리가 남았다. 분리는 음악을 지우지 노이즈를 지우지 않습니다. 이퀄라이저로 양 끝을 다듬고(웅웅거림엔 저역 컷, 히스엔 8~16 kHz 살짝 컷), 심한 노이즈에는 전용 노이즈 제거 도구를 쓰세요.
이퀄라이저가 파일을 디코딩할 수 없다고 한다. MP3, WAV, M4A를 쓰세요. 영상 파일 속 특이한 코덱 중에는 브라우저가 디코딩하지 못하는 것이 있으니 먼저 MP3로 변환하세요.
내보내기가 실패했다. 아주 긴 파일은 브라우저 메모리를 다 써 버릴 수 있습니다. 녹음을 짧게 나눠 하나씩 내보내세요.
이걸로 해결되는 실제 상황
- 카페 음성 메모. 휴대폰에 노래 아이디어를 녹음했는데 카페 스피커에서 팝송이 나오고 있었다. 분리해 목소리만 남기고 가이드 보컬로 쓰세요.
- 연설 영상. 밴드가 연주하는 동안 찍은 결혼식 축사. 분리한 목소리를 팟캐스트 프리셋에 통과시키면 하이라이트 영상에 쓸 만큼 또렷해집니다.
- 음악이 새어 든 팟캐스트 녹음. 누군가 인터뷰 중에 플레이리스트를 틀어 뒀다. 분리하면 재녹음 없이 살릴 수 있습니다.
- 브이로그의 저작권 음악 바꾸기. 분리해 목소리를 남기고, 내 소유의 곡을 밑에 까세요. 예를 들어 AI 음악 생성기로 직접 만든 곡이요. 플랫폼이 무엇을 걸러내는지는 유튜브용 AI 음악 가이드에서 다룹니다.
- 노래방 트랙 위에서 노래하기. 커버용으로 목소리를 남기거나 연습용으로 반주를 남기세요. 노래방이 목적이라면 노래방 버전 만드는 법 가이드가 그 방향을 안내합니다.
자주 묻는 질문
음성 녹음에서 배경 음악을 지우는 건 무료인가요?
이퀄라이저 단계는 무료이고 계정도 필요 없습니다. 분리 단계는 저희 서버의 AI를 쓰므로 한 번에 10크레딧이 듭니다. 새 계정은 분리 한 번에 충분한 무료 크레딧 16개를 받습니다.
어떤 파일을 올릴 수 있나요?
MP3, WAV, M4A, 또는 MP4 영상(오디오 트랙 사용)이며, 파일당 10 MB까지입니다.
음악도 돌려받나요?
네. 분리할 때마다 파일 두 개 — 분리된 목소리와 목소리가 빠진 음악 — 가 나옵니다. 둘 다 작업 목록에서 재생하고 내려받을 수 있습니다.
바람, 히스, 차 소리도 지워지나요?
아니요. 분리는 목소리와 음악을 나누도록 만들어졌고, 노이즈는 대상이 아닙니다. 목소리 건져내기 페이지에도 그렇게 적혀 있습니다. 이퀄라이저로 히스와 웅웅거림을 누그러뜨릴 수는 있지만, 심한 노이즈에는 노이즈 제거 도구가 필요합니다.
시간은 얼마나 걸리나요?
대부분의 녹음은 길이에 따라 1~3분이면 끝납니다. 작업은 백그라운드에서 돌아가니 페이지를 떠났다가 돌아와도 됩니다.
내 녹음이 저장되나요?
올린 파일은 그 분리에만 쓰이고 작업이 끝나면 삭제됩니다. 이퀄라이저는 아예 아무것도 업로드하지 않습니다.
깨끗해진 목소리를 상업적으로 써도 되나요?
내 녹음이라면 됩니다. 녹음을 분리해도 소유권은 바뀌지 않으므로, 다른 사람의 상업 음원에서 뽑은 트랙은 여전히 개인적 용도로만 쓸 수 있습니다.
마무리
배경 음악 때문에 망친 좋은 음성 녹음은 오디오에서 가장 고치기 쉬운 문제 중 하나입니다. 배경 음악 제거로 분리해 목소리와 음악을 두 파일로 만들고, 이퀄라이저에서 팟캐스트나 보컬 프리셋으로 2분 다듬어 내보내세요. 기대는 솔직하게 — 걷어내는 건 음악이지 바람이나 히스가 아닙니다 — 가지면, 카페 메모도, 촬영한 연설도, 방해받은 팟캐스트 녹음도 대부분 다시 쓸 수 있게 됩니다.
