Parte do nosso guia para transcrever qualquer instrumento.
Muita gente consegue cantar uma melodia muito antes de saber escrevê-la. Você acorda com uma música na cabeça, canta no celular para não esquecer e ela fica lá, um arquivo de áudio que você tem um certo medo de apagar. Passar essa linha cantada para a partitura significava descobrir nota por nota num teclado. Hoje não precisa mais. A transcrição com IA escuta uma gravação de voz e entrega a melodia na pauta. Isso funciona até certo ponto, e alguns cuidados na gravação e na revisão deixam o resultado bem mais limpo.
Por que uma melodia cantada é mais difícil do que parece
O piano facilita a vida de um modelo de transcrição. A tecla desce, a nota começa numa altura definida e o som morre de um jeito previsível. A voz não faz quase nada disso de forma limpa. A gente entra nas notas deslizando por baixo, sai delas escorregando, coloca vibrato que faz a afinação oscilar de propósito e canta várias notas numa só sílaba, o chamado melisma. No meio disso, respirações e consoantes cortam a linha com sons que não têm altura nenhuma. Para um modelo que precisa decidir onde uma nota termina e a próxima começa, um canto expressivo pode soar como uma mancha longa e instável, e não como uma fileira arrumada de notas.
Nada disso torna o trabalho impossível. Só explica por que uma transcrição de voz pede um pouco mais de revisão do que uma de piano, e onde olhar quando você revisar. Quanto mais limpo e intencional o canto, mais certo sai o primeiro rascunho. Em qualquer instrumento, uma linha única dá menos trabalho do que uma textura densa, e nosso texto sobre transcrição monofônica e polifônica explica por que uma linha vocal sozinha é o caso fácil.
O que o modelo de voz acerta
A boa notícia é que a maioria das ideias vocais cai justamente no caso fácil: uma pessoa, uma linha, nenhuma harmonia para desembaraçar. Entregue ao modelo uma melodia bem cantada e o contorno aparece, as notas sustentadas caem no lugar e você tem o desenho da música na pauta no tempo de passar um café. Para quem compõe e está trabalhando numa topline, para quem canta num coral e quer sua parte escrita, ou para quem só quer guardar a ideia em partitura, isso já resolve o principal.
No Songscription, o modelo de voz é o mais novo e ainda aparece como experimental, enquanto o piano é o caminho mais desenvolvido. Preferimos contar isso a prometer mais do que entregamos. Na prática, uma linha vocal limpa e simples sai bem transcrita, e uma rápida e cheia de ornamentos precisa de mais limpeza. Isso acontece com qualquer ferramenta, não só com a nossa.
O que gravar para ter um resultado limpo
Algumas escolhas na hora de gravar pesam mais do que qualquer ajuste depois:
- Cante uma nota de cada vez. Segure a vontade de deslizar e entrar por baixo enquanto está registrando a ideia. A expressão você coloca de volta depois; o modelo só precisa ouvir notas bem separadas.
- Escolha uma sílaba neutra. Cantarolar ou cantar numa sílaba aberta, como “a” ou “lá”, deixa as notas mais claras do que a letra inteira, porque consoantes fortes cortam o som por um instante.
- Grave seco e de perto. Um cômodo silencioso, com pouco reverb, e o microfone razoavelmente perto dão ao modelo o sinal mais claro para ler.
- Mantenha o pulso firme. Bater o pé ou cantar junto com um clique baixinho ajuda o ritmo a sair certo, e não como um emaranhado de figuras estranhas.
- Isole a voz. Se a voz está enterrada numa base instrumental, o caminho mais limpo é transcrever uma gravação só da voz.
Da gravação ao lead sheet
O processo em si é curto, e o Songscription foi feito exatamente para isso. Ele isola uma única linha de uma gravação e escreve essa linha em partitura que você edita direto no navegador, com um modelo pensado para voz cantada e cantarolada, e não para piano. Envie sua gravação, escolha voz como instrumento e mande transcrever a linha. Em um ou dois minutos a melodia está na pauta, na sua frente. Se a música tem acompanhamento por baixo da voz, a detecção de acordes pode colocar cifras acima da pauta, e aí a melodia vira um lead sheet de verdade, o formato com melodia e cifras que quem canta e toca em banda costuma usar.
A partir daí você molda do jeito que quiser. Transponha para uma tonalidade que caia bem para quem canta, diminua a velocidade de reprodução sem mudar o tom para conferir uma frase complicada e, quando a leitura estiver do jeito que você quer, exporte em PDF para a estante ou em MusicXML para continuar editando no MuseScore, no Sibelius ou no Dorico. Se você está começando de uma gravação rápida no celular, e não de um take pronto, nosso guia sobre como transformar um áudio de voz em partitura mostra essa versão do mesmo trabalho.
Como corrigir os pontos tortos
Conhecer os erros mais comuns deixa a revisão rápida, porque você confere coisas específicas em vez de ler tudo do zero:
- Entradas por baixo e slides. Onde você deslizou até uma nota, o modelo pode escrever as notas do caminho. Junte tudo na nota única que você queria.
- Melisma. Uma sequência de notas numa só sílaba pode voltar com o ritmo arredondado. Escute e acerte as figuras.
- Saltos de oitava. A voz pode ficar numa região em que o modelo escolhe a oitava errada para uma ou duas notas. É fácil de ver e fácil de ajustar.
- Respiração lida como pausa. Quase sempre isso não atrapalha, mas de vez em quando uma respiração vira uma pausa estranha que você vai querer arrumar.
É o mesmo hábito de revisão que bons músicos têm com qualquer transcrição automática, e nosso texto sobre como corrigir erros de transcrição com IA entra mais a fundo nesses ajustes. Em dois minutos, a ferramenta leva você da página em branco a um rascunho sólido, e você gasta seu tempo com as decisões musicais em vez de catar nota por nota no teclado.
Perguntas frequentes
A IA consegue transformar uma gravação de voz em partitura?
Sim, para a melodia. A transcrição com IA escuta uma linha cantada ou cantarolada e escreve as notas e o ritmo em partitura que você pode ler e editar. Funciona melhor com uma única linha bem cantada, e em um ou dois minutos você tem a melodia na pauta. O modelo de voz é mais novo que o de piano, então trate o resultado como um bom primeiro rascunho para revisar, principalmente onde a voz entra na nota por baixo, desliza entre notas ou faz melismas rápidos.
A transcrição inclui a letra?
Não. A transcrição pega as notas e o ritmo da linha vocal, não as palavras. Se quiser a letra embaixo da pauta, você acrescenta por conta própria no editor ou num programa de partitura depois de exportar. Da gravação vêm a melodia, o tom e o ritmo, mas não a letra.
Como consigo a transcrição de voz mais precisa?
Grave a voz sozinha, perto do microfone, num ambiente com pouco eco, e cante cada nota bem definida em vez de deslizar de uma para outra. Manter o pulso firme ajuda o ritmo a sair certo. Se a voz estiver dentro de uma mixagem completa, isole a voz antes. Depois compare o rascunho com a gravação e corrija os pontos em que uma entrada por baixo ou um melisma confundiu o modelo.
Posso mudar o tom para caber na minha extensão?
Sim. Depois que a melodia estiver transcrita, você pode transpor para cima ou para baixo no editor até ela ficar numa extensão confortável para quem canta, e aí exportar de novo. A transposição muda tanto as notas na tela quanto a reprodução, então o que você ouve bate com o que você lê.
Tem uma melodia parada nos áudios do seu celular? Comece em áudio para partitura, escolha voz como instrumento e transforme a música que está na sua cabeça numa página para guardar. Se preferir tirar os acordes de uma música completa, nosso guia sobre como tirar os acordes de qualquer música explica o caminho.
