CourionAI
ES
Boletín
← Todas las noticias
local-ai 3 min de lectura

StemDeck divide las canciones en sus partes en su propia máquina, de forma gratuita

Una nueva aplicación de código abierto extrae voces, batería, bajo, guitarra y piano de cualquier pista utilizando el modelo Demucs, completamente fuera de línea. Sin cuenta, sin carga, sin suscripción.

Una sola onda de sonido gruesa que se divide en seis cintas, cada una de las cuales se enrosca en su propio canal de una mesa de mezclas.

Si alguna vez quisiste las voces de una pista para poder cantar sobre ella, o solo la parte de batería para poder aprenderla, probablemente te hayas topado con un sitio web pago que desea cargarla y una suscripción. StemDeck es una nueva aplicación gratuita y de código abierto que hace el mismo trabajo en su propia computadora. Introduzca un archivo MP3, WAV, FLAC, OGG, MP4 o M4A, o pegue un enlace de YouTube, y separará el audio en hasta seis temas: voz, batería, bajo, guitarra, piano y todo lo demás.

La reproducción se realiza en un mezclador que le resultará familiar a cualquiera que haya abierto un software de grabación. Puede silenciar y aplicar solo partes individuales, ajustar niveles, ampliar la forma de onda, hacer un bucle en una sección y exportar plicas individuales o una mezcla personalizada. Se ejecuta en Windows, macOS y Linux. Debajo del capó, utiliza htdemucs_6s, un modelo del proyecto de código abierto Demucs, y elige el procesador más rápido que puede encontrar en su máquina: CUDA en tarjetas gráficas Nvidia, MPS en Apple Silicon y CPU simple si ninguno está disponible. La CPU funciona, solo que es más lenta. El proyecto se describe a sí mismo como alfa, por lo que se esperan asperezas.

Qué está pasando realmente aquí: la separación de fuentes solía ser realmente difícil. Una vez que los instrumentos se mezclan en dos canales, la información sobre de qué sonido vino y dónde desaparece, y el modelo tiene que reconstruirla a partir de patrones aprendidos de cómo se ve una trampa o una voz humana en un espectrograma. Demucs y sus sucesores resolvieron esto lo suficientemente bien como para que los resultados sean utilizables, y el cambio interesante es que el modelo es lo suficientemente pequeño como para ejecutarse en hardware normal. Ésa es la tendencia silenciosa detrás de gran parte de la IA local: no es que las computadoras portátiles se hayan vuelto lo suficientemente potentes para los modelos de vanguardia, sino que los modelos especializados útiles se han vuelto pequeños. Los servicios comerciales aquí son en su mayoría una interfaz amigable más una factura envuelta en un modelo que es gratuito.

Qué significa esto para ti: si eres músico, DJ, profesor o alguien que está aprendiendo a tocar un instrumento, esto vale veinte minutos de tu velada. Practicar con una pista sin el bajo es una forma realmente buena de aprender y no cuesta nada. El ángulo de la privacidad también importa: su audio nunca sale de su máquina, lo cual es la diferencia entre experimentar libremente y pensar dos veces antes de cargar una demostración inédita de alguien. Dos advertencias honestas. La separación nunca es perfecta y escucharás artefactos en mezclas densas, especialmente cuando la guitarra y el piano se superponen. Y separar una pista no te otorga derechos sobre ella. La práctica, la transcripción y el aprendizaje están bien, pero para publicar un remix aún se necesita el permiso de quien sea el propietario de la canción.

Fuentes

Fuentes: https://github.com/stemdeckapp/stemdeck

Siguiente artículo

Tencent Open-Sources Hy4, un modelo de 770 mil millones de parámetros creado para el trabajo de oficina

Tencent lanzó la vista previa de Hy4 con 770 mil millones de parámetros totales, 49 mil millones activos y una ventana contextual de más de un millón de tokens. Lo inusual es para qué fue optimizado: hojas de cálculo, documentos y largas sesiones de codificación.

La puerta de una bóveda se abrió y dio paso a una profunda red de cubos modulares, de los cuales sólo unos pocos dispersos estaban iluminados.