Removedor de vocal: tire a voz de qualquer música no navegador

O SplitVocals é um removedor de vocal com IA que roda no seu próprio dispositivo. Solte uma música e receba o instrumental de volta, com a voz isolada saindo da mesma passada — sem upload e sem conta na separação no navegador. HD Pack e Pro adicionam qualidade HD feita no servidor.

A separação em 4 faixas no navegador não tem custo. HD no servidor, 6 faixas, lotes e FLAC são pagos — veja os preços.

Tirar a voz

ou solte aqui · MP3, WAV, FLAC, M4A, OGG · até 50 MB / 10 min

A separação no navegador roda localmente · Só envia se você escolher HD

O que um removedor de vocal com IA faz de verdade

Removedor de vocal, durante muito tempo, era um truque de fase: inverte um canal do estéreo, soma os dois, e o que estava exatamente no centro — quase sempre a voz — some. Só que o bumbo, o baixo e tudo mais que foi mixado no meio somem junto, e é por isso que aquele playback de YouTube soa oco. O SplitVocals não filtra nada. Ele roda o Demucs v4, um modelo de IA treinado para reconhecer a voz cantada como uma fonte própria dentro da mixagem pronta, e reconstrói a voz e o resto da banda como faixas separadas.

Como a voz é separada e não cancelada, o instrumental mantém o grave inteiro e os instrumentos do centro, e a voz sai como um stem que dá para usar. Uma passada entrega os dois: baixe o instrumental, a voz isolada ou todos os stems que o modelo produziu (voz, bateria, baixo e outros — guitarra, teclado, sopros).

Removedor de vocal ou criador de karaokê: qual página usar?

As duas páginas rodam a mesma separação; a diferença é para quem cada uma foi escrita. O criador de karaokê é para quem vai cantar por cima do playback hoje à noite. Esta página é para todo o resto: produtor que quer um instrumental limpo de funk ou de pagode para samplear e remixar; quem edita vídeo para o Reels ou o YouTube e precisa da música sem a letra embaixo da narração; DJ de baile montando uma edit que derruba a voz por oito compassos; violonista ou tecladista que quer tocar a melodia do sertanejo por cima da banda original. Se precisa do contrário — só a voz — o extrator de acapella tira isso do mesmo modelo.

Quando a voz não some por completo

O modelo remove toda voz que encontra, principal e backing vocal, então o coro de harmonias vai embora junto com o cantor em vez de ficar no instrumental. O que ele não faz é desfazer a gravação. Um reverb longo ou um delay na voz faz parte da fonte de voz e sai quase todo com ela, mas em mixagem muito molhada pode sobrar um rastro. O caso mais difícil é o de sempre no Brasil: a versão do DVD ao vivo, em que o cantor vaza nos microfones da bateria e a plateia canta o refrão inteiro — e plateia também é voz. Louvor gravado no culto chega no mesmo problema por outro caminho: coral e backing vocal alto na mixagem grudam no instrumental, e áudio captado no celular no meio da igreja não tem separação que salve. Arquivo baixado do YouTube em qualidade baixa ou encaminhado pelo WhatsApp dá ao modelo menos material para trabalhar.

Se o instrumental não sair limpo, comece pela versão de estúdio em vez da ao vivo ou do remaster, e entregue o melhor arquivo que tiver — um WAV ou FLAC em vez de um MP3 de 128k. O HD Pack e o Pro rodam um modelo maior no servidor para as músicas que precisam, com bem menos vazamento.

No seu dispositivo, não num servidor

Cada etapa — decodificar o arquivo, rodar o modelo, mixar o instrumental — acontece dentro da aba do navegador, por WebGPU ou WebAssembly. Nada é enviado, então não existe tempo de upload de um WAV grande (e upload é sempre a metade mais lenta da internet aqui), não existe fila atrás do trabalho dos outros e não existe cobrança por minuto. Dá para conferir: abra a aba Rede das ferramentas de desenvolvedor durante uma separação e não vai aparecer nenhuma requisição levando o seu áudio. Para quem processa no celular com pacote de dados, isso também significa que nenhum megabyte da música sai do aparelho.

A primeira vez baixa o modelo de ~170 MB para o cache do navegador; depois disso, as separações começam na hora, até sem internet. Chrome e Edge usam a placa de vídeo e terminam uma música típica em um a três minutos; Safari e Firefox vão pela CPU, mais devagar, com o mesmo resultado. No celular funciona, mas demora mais que no computador — e vale deixar o modelo baixar no Wi-Fi da primeira vez, para não gastar o pacote de dados com ele.

Como funciona

  1. 1

    Solte uma música

    MP3, WAV, FLAC, M4A, OGG ou AAC, até 50 MB ou 10 minutos.

  2. 2

    A IA separa no seu dispositivo

    Um modelo Demucs v4 roda localmente via WebGPU ou WebAssembly — nada é enviado.

  3. 3

    Ouça, sole e baixe

    Escute cada stem e exporte em WAV, MP3 320k ou um ZIP com os quatro.

Por que rodar localmente faz diferença

Privado por design

O seu áudio é decodificado e processado dentro da aba do navegador. Não existe etapa de upload, então não há nada para uma política de privacidade prometer — confira você mesmo na aba Rede.

Sem fila, sem espera

O processamento começa no instante em que você solta o arquivo. Não existe fila de renderização no servidor, então um dia movimentado para os outros nunca atrasa você.

Funciona offline depois do primeiro uso

O modelo de IA baixa uma vez (cerca de 170 MB) e fica no cache do navegador. Volte amanhã, mesmo sem internet, e a separação continua funcionando.

Sem custo por música

Não há processamento de servidor por música para pagar na separação no navegador, então nada é medido. O HD no servidor é a exceção paga, e avisa antes de você clicar.

O que está incluído, e o que é pago.

A separação em 4 faixas no navegador desta página não tem custo nem teto de músicas. O HD Pack e o Pro existem para a parte que precisa de servidor: qualidade HD de estúdio, mais faixas, lotes e arquivos sem perda.

Separação no navegador

US$ 0

  • Separação em 4 faixas, no seu dispositivo, sem teto de músicas
  • Sem conta, sem upload, sem fila
  • Download em MP3 e WAV, sem marca d'água
  • Mantido por anúncios

HD Pack e Pro

HD Pack $4.99 pagamento único · Pro $5.99/mês ou $39/ano

  • Voz e playback em HD processados no servidor, mais limpos do que o navegador consegue
  • 6 faixas, incluindo guitarra e piano (Pro)
  • Lotes de 5 arquivos e exportação FLAC sem perda (Pro)
  • Sem anúncios (Pro)
Ver preços

Perguntas frequentes

Como tiro a voz de uma música?
Como tiro a voz de uma música?
Solte o arquivo de áudio na caixa no topo desta página. O SplitVocals separa a música no seu dispositivo e devolve um instrumental sem a voz, pronto para baixar em WAV ou MP3 320k, junto com a voz isolada e os outros stems.
O removedor de vocal tira também o backing vocal e as harmonias?
O removedor de vocal tira também o backing vocal e as harmonias?
Tira. O modelo trata toda voz cantada como parte da fonte de voz, então backing vocal, harmonias, coral e a plateia cantando junto vão embora com o cantor principal. Não existe ajuste que mantenha as harmonias e remova só o solista.
Tirar a voz é pago?
Tirar a voz é pago?
Não — nesta página a separação roda no seu próprio dispositivo, e não num servidor com medidor, então não tem cobrança por música nem limite diário. O HD Pack e o Pro, que são pagos, adicionam qualidade HD feita no servidor, seis stems, lotes e exportação em FLAC; a página de preços lista o que cada um custa.
Dá para fazer o contrário e manter só a voz?
Dá para fazer o contrário e manter só a voz?
Dá. A mesma separação produz a voz isolada, que você baixa ao lado do instrumental. A página do extrator de acapella é construída em cima exatamente desse resultado — é o que o MC de funk usa para gravar por cima de outra base.
Qual a diferença entre esta página e o criador de karaokê?
Qual a diferença entre esta página e o criador de karaokê?
O motor é o mesmo. A página do criador de karaokê foi escrita para quem canta — cantor de casamento, ministério de louvor da igreja, quem grava cover — e já abre no playback para cantar junto; esta página cobre todos os outros motivos para tirar a voz: samplear, remixar, trilha de vídeo, edit de DJ, estudo. E explica o que esperar da voz isolada também.
De quais formatos consigo tirar a voz?
De quais formatos consigo tirar a voz?
MP3, WAV, FLAC, M4A, OGG, AAC e WebM, até 50 MB ou 10 minutos por arquivo. Gravação mais longa, corte antes ou divida em partes.