RessourcenMusiktranskriptionAndrew Carlins•8 Min. Lesezeit

Warum Instrument für Instrument besser funktioniert als alles in einem Durchgang

Manche Tools versprechen, eine ganze Band in einem einzigen Durchgang in einzelne Stimmen aufzuteilen. Das klingt bequem, oft kommt dabei aber eine grobe Annäherung an alle Stimmen gleichzeitig heraus. Transkribierst du ein Instrument nach dem anderen, bekommst du sauberere, besser bearbeitbare Noten, und aus diesen Stimmen setzt du danach ein komplettes Arrangement zusammen.

Warum ein Instrument nach dem anderen sauberere, besser bearbeitbare Stimmen ergibt als eine Transkription aller Instrumente in einem Durchgang, und wie du daraus Noten für die ganze Band zusammensetzt

Teil unseres Leitfadens zum Transkribieren einer ganzen Band.

Manche Transkriptionstools versprechen, eine komplette Bandaufnahme in einem einzigen Durchgang in einzelne Stimmen aufzuteilen, also Drums, Bass, Gitarre, Keys und Gesang auf einmal in Noten zu bringen. Das klingt erst mal ideal, weil du nur einmal hochlädst und sofort die ganzen Noten hast. Diese Bequemlichkeit hat aber ihren Preis, und den solltest du kennen, bevor du entscheidest, welcher Weg zu der Musik passt, an der du gerade arbeitest.

Die beiden Wege

Bei der Transkription mehrerer Instrumente in einem Durchgang nimmt das Modell den kompletten Mix und versucht, alles gleichzeitig zu erledigen. Es soll jedes Instrument erkennen, die Noten voneinander trennen und alle Stimmen in einem Schritt aufschreiben. Reizvoll ist das, weil es nur ein einziger Schritt ist. Dafür muss das Modell aber sehr viel sich überlagernden Klang auf einmal entwirren, und in der Praxis kommt bei jeder Stimme eine gröbere Annäherung heraus.

Der andere Weg ist, jeweils ein Instrument oder eine Stimme zu transkribieren. Du sagst Songscription, welches Instrument du willst, und das Modell holt diese Stimme selbst aus dem kompletten Mix. Den Song vorher in Stems aufzuteilen, ist also nicht nötig. Das sind mehr Schritte als ein einzelner Klick, aber jeder Schritt ist für das Modell viel einfacher, und das Ergebnis wird meist genauer. Wie Material mit mehreren Instrumenten genau verarbeitet wird, liest du im Artikel darüber, ob KI mehrere Instrumente transkribieren kann.

Songscription ist bewusst auf den zweiten Weg ausgelegt. Es transkribiert jeweils ein Instrument oder eine Stimme und zerlegt keine ganze Band in einem Durchgang in alle einzelnen Stimmen. Wir geben dir lieber für jedes Instrument eine saubere, genaue und bearbeitbare Stimme als eine einzige grobe Aufteilung von allem auf einmal.

Warum einzelne Instrumente sauberer werden

Der Grund ist der Fokus. Ein kompletter Mix ist eine dichte Klangwand, in der sich alles überlagert. Ein Basston, ein Gitarrenakkord und die Kickdrum können im selben Moment und im selben Frequenzbereich liegen. Soll ein Modell das alles auf einmal notieren, muss es raten, welche Note zu welchem Instrument gehört, und diese Vermutungen summieren sich zu Fehlern. Fragst du dagegen nach einem einzigen Instrument, wird die Aufgabe viel einfacher, denn das Modell schreibt dann nur die Noten einer Stimme auf. Je enger das Ziel, desto genauer das Ergebnis. Die Modelle von Songscription sind in der Regel robust genug, um das gewünschte Instrument direkt aus einem kompletten Mix herauszuholen.

Weil das Modell die Stimme selbst aus dem Mix zieht, musst du den Song vorher nicht in Stems aufteilen. Bei einer besonders dichten, vollen Aufnahme kann eine optionale Stem-Trennung die Stimme noch sauberer machen. Sie holt vor der Transkription zum Beispiel die Gitarre, den Bass oder die Gesangsmelodie aus dem Mix. Das hilft, ist aber keine Voraussetzung. Der Weg über einzelne Instrumente bringt dir im Alltag zwei Vorteile. Jede Stimme ist genau, und weil sie eine eigene, gezielte Transkription ist, lässt sie sich auch besser bearbeiten. Außerdem suchst du selbst aus, welches Instrument du willst und in welchem Schwierigkeitsgrad, statt zu nehmen, was eine Aufteilung in einem Durchgang gerade ausgespuckt hat. Den ganzen Ablauf Schritt für Schritt zeigt der Leitfaden zur Instrumententranskription.

Noten für die ganze Band zusammensetzen

Wer jedes Instrument einzeln transkribiert, muss auf ein komplettes Arrangement nicht verzichten. Du baust es eben aus sauberen Stimmen. Der Ablauf ist einfach: Du transkribierst ein Instrument nach dem anderen, lässt das Modell jede Stimme aus dem Mix holen und hast am Ende bearbeitbare Noten für jedes Instrument. Danach kannst du die Stimmen zu einem Arrangement zusammenführen, allen in der Band nur ihre eigene Stimme geben oder den Schwierigkeitsgrad einer einzelnen Stimme ändern, ohne die anderen anzufassen. Weil jede Stimme für sich transkribiert wurde, sind die zusammengesetzten Noten genauer als eine Aufteilung derselben Aufnahme in einem Durchgang. Wie du mit einer Mehrspur-Quelle arbeitest, steht in Mehrspur-Audio in Noten transkribieren.

Hast du keine einzelnen Spuren, sondern den fertigen Mix einer ganzen Band, gilt dieselbe Logik. Transkribier eine Stimme nach der anderen und lass das Modell jedes Instrument aus dem Mix holen. Für die dichtesten Passagen hast du die optionale Stem-Trennung in Reserve. Der Artikel Eine komplette Bandaufnahme transkribieren zeigt den ganzen Weg, vom kompletten Mix bis zu den einzelnen Stimmen, aus denen das Arrangement besteht. Ehrlich gesagt ist das mehr Arbeit als ein einziger Klick. Dafür bekommst du Genauigkeit, und jede Stimme, die du zusammensetzt, bleibt bearbeitbar, statt festgeschrieben zu sein.

Welchen Weg du wählst

Brauchst du nur eine Stimme, etwa die Klavierstimme oder den Bass, ist es schneller und sauberer, genau dieses Instrument zu transkribieren, als eine komplette Aufteilung laufen zu lassen und das meiste davon wegzuwerfen. Brauchst du ein komplettes Arrangement, sind es auf dem Weg über einzelne Instrumente mehr Schritte, aber du bekommst genauere Noten und hast jede Stimme selbst in der Hand. Ein Durchgang für alles ist nur dann richtig, wenn du schnell eine grobe Skizze von allem willst und Genauigkeit keine große Rolle spielt. Die meisten, die Musik in ein Transkriptionstool laden, wollen am Ende aber eine Stimme, die sie wirklich lesen, spielen und bearbeiten können. Dafür ist es der bessere Weg, ein Instrument nach dem anderen zu transkribieren.

Häufige Fragen

Ist die Transkription mehrerer Instrumente in einem Durchgang besser?

Tools, die eine ganze Band in einem Schritt in einzelne Stimmen aufteilen, sind bequem, aber diese Bequemlichkeit geht auf Kosten der Genauigkeit. Soll ein Modell jedes Instrument gleichzeitig hören und notieren, muss es nebenbei auch noch sich überlagernde Frequenzen entwirren. Darunter leidet jede einzelne Stimme. Transkribierst du ein Instrument nach dem anderen, arbeitet das Modell mit einem saubereren Signal, und jede Stimme wird genauer und lässt sich besser bearbeiten. Der Weg über einzelne Instrumente hat mehr Schritte, dafür liegt das Ergebnis näher an dem, was du tatsächlich gespielt hast.

Warum sollte ich jedes Instrument einzeln transkribieren?

Konzentriert sich das Modell auf eine Stimme statt auf die ganze Band, muss es nicht raten, welche Note zu welchem Instrument gehört. Tonhöhen, Rhythmen und Timing sitzen dadurch genauer. Die Modelle von Songscription sind in der Regel robust genug, um das gewünschte Instrument direkt aus einem kompletten Mix zu holen, du musst den Song also vorher nicht in Stems aufteilen. Und du wählst für jede Stimme selbst das Instrument und den Schwierigkeitsgrad, statt zu nehmen, was eine Aufteilung in einem Durchgang entschieden hat. Wegen dieser Kontrolle und des saubereren Ergebnisses transkribiert Songscription jeweils ein Instrument oder eine Stimme.

Wie bekomme ich Noten für die ganze Band, wenn ich jedes Instrument einzeln transkribiere?

Du transkribierst jede Stimme für sich und fügst sie danach zusammen. Wähl in Songscription jeweils ein Instrument aus, etwa Drums, Bass, Gitarre, Keys oder die Gesangsmelodie. Das Modell holt diese Stimme dann aus dem kompletten Mix. So bekommst du für jedes Instrument saubere, bearbeitbare Noten, ohne den Song vorher in Stems aufzuteilen. Weil jede Stimme eine eigene bearbeitbare Transkription ist, kannst du sie zu einem kompletten Arrangement zusammensetzen, den Schwierigkeitsgrad einer einzelnen Stimme anpassen oder allen in der Band nur ihre eigene Stimme geben. Das sind mehr Schritte als bei einer Aufteilung in einem Durchgang, aber jede Stimme in den fertigen Noten ist genauer.

Dauert es länger, jedes Instrument einzeln zu transkribieren?

Ja, es sind mehr Schritte als bei einer Aufteilung in einem Durchgang, weil du jede Stimme einzeln transkribierst und sie danach zusammensetzt. Diesen Mehraufwand nimmst du bewusst in Kauf. Jeder Durchgang arbeitet mit einem saubereren Signal, deshalb wird jede Stimme genauer und lässt sich besser bearbeiten, und du bestimmst, welches Instrument und welchen Schwierigkeitsgrad du bekommst. Für eine einzelne Stimme lässt du die Transkription nur einmal laufen. Bei einem kompletten Arrangement bringen dir die zusätzlichen Schritte Noten, die näher an der Aufnahme liegen und sich leichter korrigieren lassen.

Am schnellsten siehst du den Unterschied an einer Aufnahme, die du gut kennst. Lade sie in Songscription hoch und transkribier ein Instrument. Dann hast du eine saubere, bearbeitbare Stimme, auf der du aufbauen kannst.

Zur Person

Andrew Carlins

Geschrieben von

Andrew Carlins

Mitgründer und CEO von Songscription

Andrew hat Songscription in Stanford zusammen mit ein paar anderen Musiker:innen gegründet. Sie hatten es satt, die Noten zu den Songs, die sie spielen wollten, nirgends zu finden. Er ist mit Klavier und Baritonsaxofon aufgewachsen und stand in Musicals auf der Bühne. Das ist zwar schon Jahre her, aus dem Takt ist er nach eigener Einschätzung aber noch lange nicht. Hier schreibt er darüber, wie ein Song von der Aufnahme aufs Papier kommt.

Mehr über das Team

Hier findest du weitere Artikel zu denselben Themen.