Parte de nuestra guía para transcribir cualquier instrumento.
Casi todo el mundo puede cantar una melodía mucho antes de saber escribirla. Te despiertas con una melodía en la cabeza, la grabas en el celular para no olvidarla y ahí se queda, como un archivo de audio que te da un poco de miedo eliminar. Hasta hace poco, pasar esa línea cantada a notación significaba sacarla nota por nota en un teclado. Ya no hace falta, porque la transcripción con IA puede escuchar una grabación de voz y devolverte la melodía en un pentagrama.
Por qué una melodía cantada es más difícil de lo que parece
Con el piano, el modelo de transcripción lo tiene fácil, porque cuando bajas una tecla, la nota empieza en una altura definida y se apaga de forma predecible. La voz casi nunca hace nada de eso con limpieza. Entramos a las notas desde abajo y salimos de ellas deslizándonos, les ponemos un vibrato que hace ondular la afinación a propósito y cantamos varias notas sobre una misma sílaba, lo que se llama melisma, mientras las respiraciones y las consonantes cortan la línea con sonidos que no tienen altura. Para un modelo que tiene que decidir dónde termina una nota y dónde empieza la siguiente, una voz muy expresiva puede parecer un trazo largo e inestable en vez de una fila ordenada de notas.
Eso no hace imposible el trabajo, pero explica por qué una transcripción de voz pide un poco más de revisión que una de piano, y dónde mirar cuando la revises. Cuanto más limpio y deliberado sea el canto, más se acercará el primer borrador a lo que cantaste. Es el mismo contraste entre una sola línea y una textura densa que aparece con cualquier instrumento, y en nuestra explicación sobre transcripción monofónica y polifónica contamos por qué una voz sola es el caso fácil.
Lo que el modelo de voz hace bien
La buena noticia es que la mayoría de las ideas vocales son justo el caso fácil: una persona, una línea y ninguna armonía que desenredar. Si le das al modelo una melodía cantada con claridad, el contorno se mantiene, las notas largas caen en su lugar y tienes la forma de la melodía en un pentagrama en más o menos lo que tardas en hacer un café. Es lo que más necesita quien compone y ya tiene la melodía de una canción, quien canta en un coro y quiere su parte escrita o cualquiera que solo busca guardar su idea en notación.
En Songscription, el modelo de voz es el más reciente y todavía lleva la etiqueta de experimental, mientras que el de piano está más desarrollado. Preferimos contártelo a venderte más de lo que hay. En la práctica, una línea vocal limpia y sencilla se transcribe bien y una rápida y muy ornamentada necesita más limpieza. Eso pasa con cualquier herramienta, no solo con la nuestra.
Qué grabar para obtener un resultado limpio
Algunas decisiones al grabar pesan más que cualquier opción que cambies después:
- Canta cada nota por separado. Aguanta las ganas de deslizarte y de entrar a las notas desde abajo mientras grabas la idea. La expresión puedes añadirla después; el modelo solo necesita oír notas bien separadas.
- Elige una sílaba neutra. Si tarareas o cantas con una sílaba abierta, como «a» o «la», la altura sale más limpia que con la letra completa, porque las consonantes fuertes cortan el sonido un instante.
- Graba en seco y de cerca. Una habitación silenciosa con poca reverberación y el micrófono razonablemente cerca le dan al modelo la señal más clara.
- Mantén un tempo estable. Marcar el pulso con el pie o cantar con un metrónomo a bajo volumen ayuda a que el ritmo salga bien y no como un enredo de figuras raras.
- Aísla la voz. Si la voz está enterrada bajo una pista de acompañamiento, lo más limpio es transcribir una grabación en la que solo se oiga la voz.
De la grabación a la lead sheet
El proceso en sí es corto, y Songscription está hecho justo para esto. Aísla una sola línea de una grabación y la escribe como notación que puedes editar en el navegador, con un modelo pensado para voz cantada y tarareada y no para piano. Sube tu grabación, elige la voz como instrumento para que sepa que está escuchando a alguien cantar y deja que transcriba la línea. En uno o dos minutos tienes la melodía delante, en un pentagrama. Si la canción tiene acompañamiento debajo de la voz, la detección de acordes puede añadir símbolos de acorde encima del pentagrama, y así una melodía sola se convierte en una lead sheet de verdad, el formato de melodía y acordes con el que trabajan la mayoría de los cantantes y las bandas.
A partir de ahí, le das la forma que quieras. Transponla a una tonalidad que le quede bien a quien canta, baja la velocidad de reproducción sin cambiar la altura para revisar una frase difícil y, cuando se lea como quieres, expórtala en PDF para el atril o en MusicXML para seguir editándola en MuseScore, Sibelius o Dorico. Si partes de una grabación rápida con el celular y no de una toma terminada, nuestra guía para pasar una nota de voz a partitura explica esa variante del mismo trabajo.
Cómo corregir los puntos flojos
Conocer los errores habituales agiliza la revisión, porque buscas cosas concretas en vez de leerlo todo en frío:
- Entradas desde abajo y deslizamientos. Donde te deslizaste hacia una nota, el modelo puede escribir las alturas intermedias. Júntalas en la única nota que querías cantar.
- Melismas. Una serie de notas sobre una sola sílaba puede salir con el ritmo redondeado. Escúchala y corrige las figuras.
- Saltos de octava. La voz puede moverse en un registro en el que el modelo elige mal la octava de una o dos notas. Se ve enseguida y se corrige fácil.
- Respiraciones leídas como silencios. Casi nunca es un problema, pero de vez en cuando una respiración se convierte en un silencio raro que vas a querer ordenar.
Es el mismo hábito de revisión que aplican los buenos músicos a cualquier transcripción automática, y en nuestro artículo sobre cómo corregir errores de transcripción con IA hay más detalle sobre cada paso. La herramienta te lleva de una página en blanco a un buen borrador en dos minutos, así que tu tiempo se va en las decisiones musicales y no en sacar notas en un teclado.
Preguntas frecuentes
¿La IA puede convertir una grabación de voz en partitura?
Sí, en lo que respecta a la melodía. La transcripción con IA escucha una línea cantada o tarareada y escribe las alturas y el ritmo como notación que puedes leer y editar. Funciona mejor con una sola línea cantada con claridad, y en uno o dos minutos te da la melodía en un pentagrama. El modelo de voz es más reciente que el de piano, así que toma el resultado como un buen primer borrador que hay que revisar, sobre todo donde haya entradas desde abajo, deslizamientos y melismas rápidos.
¿La transcripción incluye la letra?
No. La transcripción recoge las notas y el ritmo de la línea vocal, pero no las palabras. Si quieres la letra debajo del pentagrama, la añades tú en el editor o en un programa de notación después de exportar. La melodía, la tonalidad y el ritmo salen de la grabación, y el texto no.
¿Cómo consigo la transcripción de voz más precisa?
Graba la voz sola, cerca del micrófono y en una habitación con poca reverberación, y canta cada nota por separado en lugar de deslizarte entre alturas. Un tempo estable ayuda a que el ritmo caiga en su sitio. Si la voz está dentro de una mezcla completa, aíslala primero. Después compara el borrador con la grabación y corrige los puntos donde una entrada desde abajo o un melisma confundió al modelo.
¿Puedo cambiar la tonalidad para que se ajuste a mi registro?
Sí. Cuando la melodía ya está transcrita, puedes transponerla hacia arriba o hacia abajo en el editor para que quede en un registro cómodo para quien canta, y después volver a exportarla. La transposición cambia tanto las notas que ves como la reproducción, así que lo que oyes coincide con lo que lees.
¿Tienes una melodía guardada en tus notas de voz? Empieza en audio a partitura, elige voz y convierte la melodía que tienes en la cabeza en una página que puedas conservar. Si prefieres sacar los acordes de una canción completa, nuestra guía para conseguir los acordes de cualquier canción lo explica.
