StemDeck zerlegt Songs kostenlos auf Ihrem eigenen Computer in ihre Teile
Eine neue Open-Source-App holt mithilfe des Demucs-Modells Gesang, Schlagzeug, Bass, Gitarre und Klavier komplett offline aus jedem Track. Kein Konto, kein Upload, kein Abonnement.
Wenn Sie schon immer den Gesang aus einem Titel haben wollten, damit Sie darüber singen können, oder nur den Schlagzeugpart, damit Sie ihn lernen können, sind Sie wahrscheinlich auf eine kostenpflichtige Website gestoßen, die einen Upload und ein Abonnement verlangt. StemDeck ist eine neue kostenlose Open-Source-App, die die gleiche Aufgabe auf Ihrem eigenen Computer erledigt. Fügen Sie eine MP3-, WAV-, FLAC-, OGG-, MP4- oder M4A-Datei ein oder fügen Sie einen YouTube-Link ein, und schon wird das Audio in bis zu sechs Stems unterteilt: Gesang, Schlagzeug, Bass, Gitarre, Klavier und alles andere.
Die Wiedergabe erfolgt in einem Mixer, der jedem bekannt vorkommt, der eine Aufnahmesoftware geöffnet hat. Sie können einzelne Parts stumm- und solo schalten, Pegel anpassen, in die Wellenform hineinzoomen, einen Abschnitt loopen und entweder einzelne Stems oder einen benutzerdefinierten Mix exportieren. Es läuft unter Windows, macOS und Linux. Unter der Haube verwendet es htdemucs_6s, ein Modell aus dem Open-Source-Demucs-Projekt, und wählt den schnellsten Prozessor aus, den es auf Ihrem Computer finden kann: CUDA auf Nvidia-Grafikkarten, MPS auf Apple Silicon und eine einfache CPU, wenn keiner verfügbar ist. CPU funktioniert, sie ist nur langsamer. Das Projekt bezeichnet sich selbst als Alpha, also erwarten Sie Ecken und Kanten.
Was hier eigentlich vor sich geht: Die Quellentrennung war früher wirklich schwierig. Sobald Instrumente in zwei Kanäle gemischt werden, ist die Information darüber, welcher Klang woher kam, verloren, und das Modell muss sie aus erlernten Mustern rekonstruieren, wie eine Schlinge oder eine menschliche Stimme in einem Spektrogramm aussieht. Demucs und seine Nachfolger haben dieses Problem so gut gelöst, dass die Ergebnisse brauchbar sind, und die interessante Veränderung besteht darin, dass das Modell klein genug ist, um auf gewöhnlicher Hardware zu laufen. Das ist der stille Trend, der vielen lokalen KI zugrunde liegt: Nicht dass Laptops leistungsstark genug für Grenzmodelle geworden sind, sondern dass nützliche Spezialmodelle kleiner geworden sind. Die kommerziellen Dienste bestehen hier hauptsächlich aus einer benutzerfreundlichen Oberfläche und einer Rechnung für ein kostenloses Modell.
Was das für Sie bedeutet: Wenn Sie Musiker, DJ, Lehrer oder jemand sind, der ein Instrument lernt, ist das zwanzig Minuten Ihres Abends wert. Das Üben zu einem Titel ohne Bass ist eine wirklich gute Lernmethode und kostet nichts. Auch der Datenschutzaspekt ist wichtig: Ihre Audiodaten verlassen nie Ihren Computer, was den Unterschied zwischen freiem Experimentieren und dem zweimaligen Überlegen, die unveröffentlichte Demo einer anderen Person hochzuladen, ausmacht. Zwei ehrliche Vorbehalte. Die Trennung ist nie perfekt und Sie werden bei dichten Mischungen Artefakte hören, insbesondere wenn sich Gitarre und Klavier überschneiden. Und wenn Sie einen Titel trennen, erhalten Sie keine Rechte daran. Üben, Transkription und Lernen sind in Ordnung, aber die Veröffentlichung eines Remixes erfordert immer noch die Erlaubnis des Besitzers des Songs.
Quellen
- StemDeck auf GitHub (StemDeck)
- StemDeck ist ein KOSTENLOSER lokaler Open-Source-Stem-Splitter (Bedroom Producers Blog)
- Kostenloser Open Source StemDeck Stem Separator für Linux, Mac und Windows (Synthtopia)
Tencent Open-Sources Hy4, ein 770-Milliarden-Parameter-Modell, das für die Büroarbeit entwickelt wurde
Tencent veröffentlichte die Hy4-Vorschau mit 770B Gesamtparametern, 49B aktiven und einem Kontextfenster über einer Million Token. Das Ungewöhnliche daran ist, wofür es optimiert wurde: Tabellenkalkulationen, Dokumente und lange Programmiersitzungen.