← Guias

Como remover a voz de uma música

Se o seu instrumental está saindo abafado, o problema quase certamente é o método — não o seu ouvido nem o arquivo.

Por que o resultado sai abafado

Se você usou o removedor de voz do Audacity, do GarageBand ou qualquer tutorial que mande inverter um canal, o resultado abafado tem explicação: esse método cancela tudo que está no centro da mixagem, não só a voz.

E o que mais mora no centro? Bumbo, caixa e baixo. Você não removeu a voz — você removeu a base rítmica junto, e sobrou o que estava nas laterais. Daí a sensação de música tocando no quarto ao lado.

O que funciona hoje

Separação por IA. Em vez de cancelar por posição, o modelo foi treinado pra reconhecer o que é voz e separar por timbre. Funciona mesmo quando a voz não está no centro, e não leva a bateria junto.

O Ultimate Vocal Remover (UVR) é gratuito, roda na sua máquina e nada sai do seu computador.

Ressalva que vale saber antes: nenhuma separação adiciona qualidade. Se o arquivo de origem é ruim, o instrumental sai ruim mais os artefatos da separação. E gravação ao vivo, com plateia e reverberação, é o cenário mais difícil que existe.

Sem IA dá?

Sinceramente: a partir de uma mixagem estéreo pronta, não existe caminho sem IA que soe bem. Se você quer controle manual, o meio-termo honesto é usar IA em um passo — a separação — e fazer todo o resto na mão. Você mantém o controle e só empresta a máquina pra única coisa que mão nenhuma faz.

Perguntas frequentes

Por que o instrumental fica abafado quando removo a voz?

Porque o método de inversão de fase cancela tudo que está no centro da mixagem, não só a voz. Bumbo, caixa e baixo moram no centro e vão junto. A solução é usar separação por IA, que separa por timbre em vez de por posição.

Qual o melhor removedor de voz gratuito?

O Ultimate Vocal Remover (UVR) é o padrão gratuito. Roda na sua própria máquina, então nenhum arquivo sai do seu computador.

Dá pra remover a voz sem usar IA?

A partir de uma mixagem estéreo pronta, não com boa qualidade. A inversão de fase só funciona quando a voz está exatamente no centro e nada mais está, o que praticamente não acontece em masterizações modernas.

O StarSinger faz esses três passos sozinho. Você sobe um arquivo que já tem, ele separa a voz, transcreve a letra com tempo por sílaba e devolve um karaokê que toca no navegador, com pontuação de afinação. É grátis hoje.

Ressalvas, porque elas são reais: a transcrição erra em voz gritada ou muito distorcida, e o processamento leva bem mais que a duração da música.

Testar de graça