드럼 분리기 — 온라인으로 드럼을 파트별로 분리
드럼 분리는 자체 스펙트럼 신경망 세 개(킥, 스네어, 탐 각각 하나)로 실행되며, 실제 드러머의 녹음 9,200개를 여덟 가지 킷 사운드로 렌더링해 학습했습니다. 하이햇 & 심벌은 나머지로 나오므로 네 파트를 합치면 손실 없이 원본 트랙이 됩니다. 모든 처리는 브라우저에서 이루어집니다: GPU(WebGPU)가 있으면 4분짜리 트랙이 몇 초 만에, 없으면 1~2분 안에 분리됩니다. 입력: 드럼 트랙 — 곡 분리로 얻은 스템, 루프, 전자 드럼 녹음, 비트; 출력: 네 파트가 함께 재생되는 콘솔이며 파트마다 솔로·음소거·음량이 있고, 파트 하나·ZIP·들리는 그대로의 믹스를 내려받을 수 있습니다. 곡 전체는 실행 전에 소리 자체로 인식합니다. 별도의 신경망(WebGPU 그래픽카드가 필요하며 한 번만 다운로드됨)이 곡에서 드럼을 뽑아내고 세 모델이 그것을 파트로 나누며, 콘솔에는 다섯 번째 트랙인 드럼 없는 음악이 추가됩니다. 드럼 파트를 끄면 드럼 없는 곡이 남습니다.
드럼을 파트별로 분리하는 방법
드럼 스템, 루프, 비트, 전자 드럼 녹음 — 또는 곡 전체: 별도의 신경망이 먼저 드럼을 뽑아냅니다. MP3, WAV, FLAC, OGG 또는 M4A.
첫 실행 때 모델 세 개를 다운로드하고, 이후에는 브라우저에서 불러옵니다. 진행 상황은 단계별로 표시됩니다.
네 파트가 같은 시계 위에서 재생되고 각각 솔로·음소거·음량이 있습니다. 킥이 홀로 어떻게 들리는지가 아니라, 나머지 키트 아래에서 깨끗하게 분리됐는지를 들을 수 있습니다.
버튼 하나로 네 파트가 오디오 믹서 페이더에 놓입니다: 밸런스, EQ, 믹스 내보내기.
드럼을 신경망으로 브라우저에서 킥, 스네어, 탐, 심벌로 나누세요
← 보컬, 베이스, 나머지를 따로 받고 싶나요? 스템 분리기 믹서에서 파트 섞기 → 드럼 제거
이 도구의 세 모델은 드럼만으로 학습했습니다. 곡 전체에서는 음악과 목소리를 타격으로 착각하므로 그대로는 드럼을 뽑아낼 수 없습니다. 먼저 곡에서 드럼을 분리해야 하며 — 별도의 신경망이 브라우저에서 바로 처리합니다 — 그다음 파트로 나눕니다. 드럼과 드럼 없는 곡을 모두 받게 됩니다.
모델(84 MB)은 한 번만 다운로드되며 그래픽카드(WebGPU)에서 실행됩니다. 게이밍급 외장 그래픽카드에서는 3~4분짜리 트랙이 약 1분 걸리고, 내장 그래픽이나 휴대폰에서는 훨씬 더 오래 걸립니다. 계산이 시작되면 남은 시간이 표시됩니다.
드럼 파트
모든 파트가 콘솔처럼 함께 재생됩니다. S는 하나만 남기고, M은 빼고, 슬라이더는 음량을 조절합니다. ‘믹스 다운로드’는 들리는 그대로 저장합니다 — 예를 들어 킥이 빠진 드럼.
드럼 사운드 교체
같은 그루브 — 다른 킷: 분리된 파트에서 킥, 스네어, 탐의 타격을 찾아 선택한 세트로 다시 연주합니다. 하이햇과 심벌은 원본 그대로 유지되며, “원본과 섞기”는 원래 소리를 다시 섞어 넣습니다.
킥, 스네어, 탐 각각 짧은 샘플(최대 5초)을 올리세요. 그루브와 타격 세기는 내 트랙에서, 소리는 내 것으로.
곡에서 드럼을 추출하는 기능은 Meta AI의 HTDemucs(MIT 라이선스)를 Tianwei Zhao의 MUSION 프로젝트가 ONNX로 내보낸 모델(CC BY 4.0)로 동작합니다. 킥·스네어·탐 모델은 자체 제작한 것으로, Groove MIDI Dataset(Google Magenta, CC BY 4.0)을 FluidR3 GM 및 Naked Drums(Wilkinson Audio, CC BY 4.0) 키트로 연주한 데이터로 학습했습니다.