Vocal Remover
Remova os vocais de qualquer música usando IA. Funciona no seu dispositivo — os arquivos nunca são enviados para a nuvem.
Arraste o arquivo de áudio para cá ou clique para selecionar um arquivo
MP3, WAV, FLAC, OGG, M4A · Até 15 minutos
Privado — processado no seu dispositivo, nunca enviado
Processamento mais rápido, download menor. Na primeira utilização, é baixado um modelo de IA de 14 MB.
Preparando...
Processando localmente
Como remover a voz
- 1 Envie uma música (MP3, WAV, FLAC, OGG)
- 2 A IA separa os vocais, a bateria, o baixo e os instrumentos
- 3 Baixe faixas individuais ou reproduza-as
Perguntas Frequentes
Qual é a diferença entre os modos “Rápido” e “Qualidade”?
O modo Rápido utiliza um modelo de 14 MB otimizado para velocidade — normalmente, de 15 a 30 segundos para uma música de 4 minutos. O modo Qualidade utiliza um modelo maior, de 32 MB, treinado com material mais diversificado, mais eficaz na preservação da clareza dos graves e no tratamento das caudas de reverberação. Escolha o modo Rápido para visualizações rápidas e o modo Qualidade para uso na produção final.
Como funciona, na prática, a remoção de voz?
Uma rede neural treinada com milhares de faixas multitrack profissionais aprende a separar os padrões de frequência dos vocais dos instrumentos. Ela processa o espectrograma de áudio em trechos sobrepostos e reconstrói formas de onda separadas para os vocais e os instrumentos.
Isso usa minha GPU?
Quando o WebGPU está disponível (na maioria dos dispositivos desktop modernos), a inferência é executada na sua GPU — de forma significativamente mais rápida do que o processamento apenas na CPU. Em dispositivos mais antigos, o sistema recorre automaticamente ao WASM multithread. Não é necessária nenhuma configuração.
Isso também vai remover os backing vocals?
O modelo separa os vocais principais e os vocais de apoio da parte instrumental. Em faixas nas quais você deseja manter as harmonias, mas remover apenas o vocal principal, os resultados podem variar — o modelo trata todo o conteúdo vocal da mesma forma.
Isso funciona com podcasts ou com fala?
Sim, embora tenha sido otimizado para música. No caso de gravações faladas com música de fundo, ele separa com eficácia a voz do acompanhamento. Para gravações faladas com apenas ruído ambiente, uma ferramenta específica para remoção de ruído pode produzir resultados mais nítidos.
E quanto ao processamento em dispositivos móveis?
Em dispositivos móveis sem memória de GPU suficiente, o processamento é automaticamente encaminhado para o Cloud Assist — um processamento seguro no lado do servidor, no qual os arquivos são excluídos imediatamente após a conclusão. Os usuários de computadores processam tudo diretamente no dispositivo.
Quais formatos de saída estão disponíveis?
Tanto a faixa vocal isolada quanto a faixa instrumental são exportadas no formato WAV sem perdas, na taxa de amostragem original. Os arquivos mantêm a mesma duração e podem ser carregados diretamente em uma DAW.