CourionAI
IT
Newsletter
← Tutte le notizie
local-ai 3 min di lettura

StemDeck divide i brani nelle loro parti sulla tua macchina, gratuitamente

Una nuova app open source estrae voce, batteria, basso, chitarra e pianoforte da qualsiasi traccia utilizzando il modello Demucs, completamente offline. Nessun account, nessun caricamento, nessun abbonamento.

Un'unica onda sonora spessa che si divide in sei nastri, ciascuno dei quali si infila nel proprio canale di un mixer

Se hai mai desiderato la parte vocale di una traccia per poterla cantare sopra, o solo la parte di batteria per poterla imparare, probabilmente ti sei imbattuto in un sito Web a pagamento che richiede un caricamento e un abbonamento. StemDeck è una nuova app gratuita e open source che svolge lo stesso lavoro sul tuo computer. Inserisci un file MP3, WAV, FLAC, OGG, MP4 o M4A o incolla un collegamento YouTube e separa l’audio in un massimo di sei radici: voce, batteria, basso, chitarra, piano e tutto il resto.

La riproduzione avviene in un mixer che sembrerà familiare a chiunque abbia aperto un software di registrazione. Puoi disattivare e mettere in solo singole parti, regolare i livelli, ingrandire la forma d’onda, eseguire il loop di una sezione ed esportare singoli gambi o un mix personalizzato. Funziona su Windows, macOS e Linux. Sotto il cofano utilizza htdemucs_6s, un modello del progetto open source Demucs, e sceglie il processore più veloce che riesce a trovare sulla tua macchina: CUDA su schede grafiche Nvidia, MPS su Apple Silicon e semplice CPU se nessuno dei due è disponibile. La CPU funziona, è solo più lenta. Il progetto si descrive come alfa, quindi aspettatevi bordi irregolari.

Cosa sta realmente succedendo qui: la separazione delle fonti era davvero difficile. Una volta che gli strumenti sono stati mescolati in due canali, l’informazione su quale suono provenisse da dove fosse scomparsa, e il modello deve ricostruirla da modelli appresi di come appare un rullante o una voce umana in uno spettrogramma. Demucs e i suoi successori hanno risolto questo problema abbastanza bene da rendere i risultati utilizzabili, e il cambiamento interessante è che il modello è abbastanza piccolo da poter essere eseguito su hardware normale. Questa è la tendenza silenziosa alla base di gran parte dell’intelligenza artificiale locale: non che i laptop siano diventati abbastanza potenti per i modelli di frontiera, ma che i modelli specializzati utili siano diventati piccoli. I servizi commerciali qui consistono principalmente in un’interfaccia amichevole e in una fattura racchiusa in un modello gratuito.

Cosa significa per te: se sei un musicista, un DJ, un insegnante o qualcuno che sta imparando uno strumento, questo vale venti minuti della tua serata. Esercitarsi su una traccia senza i bassi è davvero un buon modo per imparare e non costa nulla. Anche l’aspetto della privacy è importante: il tuo audio non lascia mai la tua macchina, che è la differenza tra sperimentare liberamente e pensarci due volte prima di caricare la demo inedita di qualcuno. Due onesti avvertimenti. La separazione non è mai perfetta e sentirete degli artefatti nei mix densi, soprattutto dove chitarra e pianoforte si sovrappongono. E separare una traccia non ti dà i diritti su di essa. Pratica, trascrizione e apprendimento vanno bene, ma pubblicare un remix richiede comunque il permesso di chi possiede la canzone.

Fonti

Fonti: https://github.com/stemdeckapp/stemdeck

Articolo successivo

Tencent Open Source Hy4, un modello da 770 miliardi di parametri creato per il lavoro d'ufficio

Tencent ha rilasciato l'anteprima Hy4 con 770 miliardi di parametri totali, 49 miliardi attivi e una finestra di contesto superiore a un milione di token. La parte insolita è ciò per cui è stato ottimizzato: fogli di calcolo, documenti e lunghe sessioni di codifica.

Una porta del caveau si aprì su una profonda griglia di cubi modulari, solo pochi di essi erano illuminati