Removedor de Vocal de Músicas Online

Separação de stems com IA — extraia instrumentais, isole acapella ou crie versões de karaokê de qualquer música. Remova vocais usando aprendizado de máquina para produção musical, prática e remix.

Como Remover Vocais de uma Música

1

Envie seu arquivo de áudio (MP3, WAV, FLAC ou qualquer outro formato)

2

Aguarde alguns segundos enquanto a ferramenta separa vocais da música

3

Ouça o resultado — ouça Música, Vocal ou ambos juntos

4

Ajuste o controle de Intensidade da Separação para resultados ideais

5

Escolha seu formato de saída (MP3, WAV ou FLAC)

6

Baixe a faixa instrumental (Música) ou vocal separadamente

Obtenha faixas instrumentais e vocais de qualquer música em segundos

Solte seu arquivo de áudio aqui
MP3, WAV, OGG, FLAC, AAC, M4A, WEBM, AIFF, OPUS, WMA, M4B, CAF
Como separar
Variantes de processamento
Este arquivo é mono — Agressivo e Duas passagens precisam de um arquivo estéreo (os algoritmos de separação dependem da imagem estéreo para isolar o vocal). O Padrão continuará funcionando.

Ouvir e ajustar

Música
Vocal
0:00 0:00
Mix rápido:
Intensidade da Separação 90%

Salvar

Opções de exportação avançadas — formatos por stem, fades, normalização LUFS
Normalização de loudness Aplica filtro EBU R128 loudnorm para combinar com alvos LUFS de streaming/broadcast. Adiciona ~3-8 s à codificação.

Cada faixa pode ser salva separadamente pelo botão na linha dela. “Mix” salva o que você ouve: os volumes atuais e a faixa selecionada.

💡 Como funciona: em «Ultra» a separação é feita por um modelo neural: ele reconhece a voz pelo timbre e não depende de onde ela está na imagem estéreo. «Rápido» funciona de outra forma: subtrai o que soa igual nos canais esquerdo e direito — quase instantâneo, porém mais grosseiro. O controle Força de separação equilibra as duas faixas.

O que funciona por dentro

Os modos não são «níveis de qualidade» de um mesmo algoritmo, e sim motores diferentes. Dois você escolhe, outros dois entram sozinhos. «Ultra» baixa primeiro um modelo — vale saber com dados móveis.

Modo O que funciona Download
Rápido · qualidade inferior Separação pela imagem estéreo: o que está no centro é subtraído espectralmente (janela de 4096, faixa de voz 100 Hz – 12 kHz). Nada — começa na hora
IA Um modelo neural de separação (ONNX). Não é selecionável: entra sozinho em arquivos mono, onde «Ultra» não funciona. Cerca de 56 MB, uma vez
Ultra · melhor qualidade MDX-Net Kim Vocal 2 — o mais preciso disponível e o mais lento. Precisa de estéreo. Cerca de 64 MB, uma vez
Vocal de apoio UVR MDX-Net Karaoke 2: uma segunda passagem sobre a voz já extraída, separando a principal dos backings. Cerca de 50 MB, uma vez

O que esperar

  • «Rápido» precisa de estéreo: uma gravação mono não tem imagem estéreo para subtrair, então as duas faixas voltam iguais. «Ultra» também precisa de estéreo e não roda em mono: ali outro motor neural assume automaticamente.
  • O modelo é baixado uma vez e fica no cache do navegador — a próxima música no mesmo navegador começa de imediato.
  • Separação perfeita não existe: quanto mais densa a mistura, mais vezes sobra um resto de voz no instrumental. A ferramenta mede esse resto e sugere uma variante mais forte.
Publicado Atualizado Autor: