Este texto faz parte do nosso glossário de termos de notação musical.
A separação de stems pega uma música pronta, daquelas em que tudo já foi mixado numa faixa só, e desmonta de volta nas partes: a voz de um lado, a bateria de outro, o baixo e as guitarras cada um na sua. Parece mágica, e alguns anos atrás era mais ou menos isso mesmo. O assunto aparece o tempo todo quando se fala de transcrição, porque isolar uma parte pode facilitar na hora de escrevê-la. Para transcrever uma gravação com o Songscription, você não precisa separar stems. A separação é uma opção útil para alguns trabalhos, e não uma etapa obrigatória.
O que é separação de stems
Stem é uma parte da música numa faixa própria. No estúdio, a música é montada em faixas separadas (voz, bateria, baixo, teclados e assim por diante), e a masterização final junta tudo num único arquivo estéreo. Depois disso, para quem ouve, as faixas individuais normalmente somem. A separação de stems desfaz essa última etapa. Só com o arquivo mixado em mãos, ela estima como soava cada parte e devolve cada uma numa faixa separada. As saídas mais comuns são voz, bateria, baixo e um grupo com todo o resto, e algumas ferramentas ainda dividem esse último grupo em piano, guitarra e outros instrumentos.
Como funciona
É um trabalho difícil. Depois de mixados, os sons se sobrepõem nas mesmas frequências e não existe uma emenda limpa por onde cortar. A separação moderna usa redes neurais treinadas com grandes coleções de músicas cujas faixas originais separadas são conhecidas. O modelo aprende a impressão digital de cada tipo de fonte (o jeito como uma voz se move, o ataque de uma caixa, o grave constante do baixo) e usa esses padrões para estimar que pedaços do som misturado pertencem a cada instrumento. A transcrição com IA parte da mesma ideia, que explicamos em como funciona a transcrição musical com IA: um modelo que aprendeu com exemplos, e não com um conjunto de regras escritas à mão.
Por que partes isoladas ajudam na transcrição
Quando um modelo de transcrição ouve a banda inteira de uma vez, ele precisa desembaraçar vários instrumentos que disputam o mesmo espaço antes de conseguir escrever qualquer coisa. Se ele recebe uma parte isolada, esse problema quase some, e ele pode se concentrar em acertar as notas de um instrumento só. Por isso, o jeito mais limpo de transformar uma música inteira numa partitura de verdade com várias pautas, cada instrumento na sua linha, muitas vezes é separar os stems primeiro e transcrever cada um com o modelo que combina com ele. Mostramos esse processo passo a passo em como transcrever áudio de banda completa e multipista.
O porém: artefatos da separação
Nenhuma separação é perfeita. Como as partes dividiam frequências na mixagem original, um stem isolado costuma vir com defeitos que entregam o processo: um som aguado ou borrado, fantasmas fracos dos outros instrumentos vazando por trás, ou uma voz que perde a respiração nas bordas. Numa audição descompromissada, isso pode incomodar. Na transcrição, costuma não atrapalhar, porque o modelo presta atenção principalmente em onde as notas começam e em qual é a altura delas, e não na limpeza do som.
Mas às vezes isso atrapalha de verdade. Se um stem volta muito deformado, transcrever esse stem pode dar um resultado pior do que transcrever a gravação original, que ainda tem toda a informação intacta. Por isso os stems são uma ferramenta a mais, e não o caminho padrão.
Você não precisa de stems para usar o Songscription
O Songscription transcreve a gravação exatamente como você envia. Você não precisa separar stems antes e, na maioria dos casos, nem compensa:
- Um instrumento só? Envie do jeito que está. Um piano ou violão solo, com acordes e tudo, é transcrito direto. Esse é o caso polifônico que explicamos em transcrição polifônica de piano explicada.
- Uma música inteira, e você quer tudo numa partitura só? Transcreva a mixagem num arranjo condensado, em geral uma redução para piano que junta melodia, harmonia e baixo numa pauta dupla. Não precisa separar nada.
- Uma música inteira, e você quer cada instrumento escrito à parte? Esse é o único caso em que dividir em stems antes costuma compensar, porque aí você transcreve cada parte sozinha.
A separação de stems entra quando o objetivo pede. Ela não é pré-requisito para tirar do Songscription uma transcrição que dê para usar, e o caminho padrão é simplesmente enviar sua gravação. Explicamos com calma como lidar com vários instrumentos ao mesmo tempo em a IA consegue transcrever vários instrumentos de uma vez?.
Quando os stems valem a pena
Separar stems compensa a etapa extra em três situações: quando você precisa de cada instrumento escrito individualmente a partir de uma gravação cheia, quando uma parte está enterrada debaixo de todo o resto e você quer ouvir e transcrever só ela, ou quando o trabalho é remixar, e não transcrever. Se o objetivo é o mais comum, aprender ou arranjar uma música, uma transcrição direta da gravação ou uma redução para piano da mixagem inteira chega lá mais rápido e não corre o risco dos artefatos. Escolha o método pelo resultado que você quer ter no fim, e só parta para a separação quando o caminho mais simples não der o layout de que você precisa. De um jeito ou de outro, o ponto de partida é a mesma gravação que você já tem.
Perguntas frequentes
O que é separação de stems?
Separação de stems é o processo de desmontar uma gravação já mixada nas partes que a compõem, chamadas stems: a voz numa faixa, a bateria em outra, o baixo e os outros instrumentos cada um na sua. As ferramentas atuais fazem isso com modelos de IA treinados com bibliotecas enormes de música. Esses modelos aprendem como soa cada tipo de fonte e tiram esse som da mixagem. Assim, uma gravação que sempre foi um único arquivo vira um conjunto de faixas isoladas, que você pode silenciar, remixar ou transcrever uma de cada vez.
Preciso separar os stems antes de transcrever?
Não. O Songscription transcreve a gravação do jeito que ela está, então você não precisa dividir tudo em stems antes. Um instrumento sozinho, mesmo com acordes cheios de piano ou violão, é transcrito direto. Uma mixagem completa pode virar um arranjo condensado, como uma redução para piano. A separação de stems é um passo extra e opcional, que pode ajudar quando você quer cada instrumento escrito na sua própria pauta a partir de uma gravação cheia. Ela não é requisito para ter uma transcrição.
A separação de stems piora a qualidade do áudio?
Pode gerar artefatos. Como as partes de uma mixagem se sobrepõem e dividem as mesmas frequências, nenhuma separação é perfeita, e os stems isolados muitas vezes ficam meio borrados, com som aguado ou com vazamento de outros instrumentos. Para ouvir, isso pode incomodar. Para transcrever, costuma ser aceitável, porque o modelo precisa principalmente saber onde cada nota começa e qual é a altura dela, e para isso o áudio não tem que ser impecável. Quando um stem sai muito deformado, transcrever a mixagem original pode até dar um resultado mais limpo.
Sem stems, sem preparação, só sua gravação. Envie uma música e transcreva do jeito que ela está.
