CourionAI
DE
Newsletter
← Glossar Modell

Demucs

Ein Open-Source-KI-Modell, das einen fertigen Song wieder in einzelne Teile wie Gesang, Schlagzeug und Bass zerlegt.

Demucs ist ein Quellentrennungsmodell, das ursprünglich von Metas Forschungsgruppe stammt und jetzt als Open Source gepflegt wird. Wenn man darüber nachdenkt, klingt seine Aufgabe unmöglich: Ein fertiges Lied besteht nur aus zwei Kanälen gemischten Klangs, und die Information darüber, welches Instrument welche Vibration erzeugt hat, ist verschwunden. Demucs rekonstruiert es trotzdem, weil es gelernt hat, wie eine kleine Trommel oder eine menschliche Stimme aussieht, wenn man Klang als Bild von Frequenzen im Zeitverlauf zeichnet.

Die neueren Varianten teilen einen Track in bis zu sechs Teile auf: Gesang, Schlagzeug, Bass, Gitarre, Klavier und alles andere. Da das Modell nach modernen Maßstäben klein ist, läuft es bequem auf einem gewöhnlichen Laptop, weshalb die meisten kostenlosen Offline-Werkzeuge zur Stieltrennung über eine benutzerfreundliche Oberfläche verfügen. Die Ergebnisse sind gut, aber nicht perfekt, und dichte Mischungen erzeugen immer noch hörbare Verschmierungen.