StemDeck divise les chansons en parties sur votre propre machine, gratuitement
Une nouvelle application open source extrait le chant, la batterie, la basse, la guitare et le piano de n'importe quelle piste en utilisant le modèle Demucs, entièrement hors ligne. Pas de compte, pas de téléchargement, pas d'abonnement.
Si vous avez toujours voulu retirer le chant d’une piste pour pouvoir chanter dessus, ou simplement la partie batterie pour pouvoir l’apprendre, vous êtes probablement tombé sur un site Web payant qui souhaite un téléchargement et un abonnement. StemDeck est une nouvelle application gratuite et open source qui fait le même travail sur votre propre ordinateur. Déposez un fichier MP3, WAV, FLAC, OGG, MP4 ou M4A, ou collez un lien YouTube, et il sépare l’audio en six tiges maximum : chant, batterie, basse, guitare, piano et tout le reste.
La lecture s’effectue dans un mixeur qui semblera familier à quiconque a ouvert un logiciel d’enregistrement. Vous pouvez couper et mettre en solo des parties individuelles, ajuster les niveaux, zoomer sur la forme d’onde, boucler une section et exporter des tiges simples ou un mixage personnalisé. Il fonctionne sous Windows, macOS et Linux. Sous le capot, il utilise htdemucs_6s, un modèle du projet open source Demucs, et sélectionne le processeur le plus rapide qu’il puisse trouver sur votre machine : CUDA sur les cartes graphiques Nvidia, MPS sur Apple Silicon et un processeur simple si aucun des deux n’est disponible. Le processeur fonctionne, il est juste plus lent. Le projet se décrit comme alpha, alors attendez-vous à des aspérités.
Que se passe-t-il réellement ici : la séparation des sources était autrefois très difficile. Une fois les instruments mélangés sur deux canaux, les informations sur l’origine du son et l’endroit où elles ont disparu, et le modèle doit les reconstruire à partir de modèles appris de ce à quoi ressemble une caisse claire ou une voix humaine dans un spectrogramme. Demucs et ses successeurs ont suffisamment bien résolu ce problème pour que les résultats soient utilisables, et le changement intéressant est que le modèle est suffisamment petit pour fonctionner sur du matériel ordinaire. C’est la tendance discrète derrière de nombreuses IA locales : non pas que les ordinateurs portables soient devenus suffisamment puissants pour les modèles frontières, mais que les modèles spécialisés utiles soient devenus petits. Les services commerciaux ici sont pour la plupart une interface conviviale et une facture enroulée autour d’un modèle gratuit.
Ce que cela signifie pour vous : si vous êtes un musicien, un DJ, un professeur ou quelqu’un qui apprend un instrument, cela vaut vingt minutes de votre soirée. S’entraîner sur un morceau sans basse est une très bonne façon d’apprendre et cela ne coûte rien. L’angle de la confidentialité est également important : votre audio ne quitte jamais votre machine, ce qui fait la différence entre expérimenter librement et réfléchir à deux fois avant de télécharger la démo inédite de quelqu’un. Deux mises en garde honnêtes. La séparation n’est jamais parfaite et vous entendrez des artefacts sur les mixages denses, en particulier là où la guitare et le piano se chevauchent. Et séparer une piste ne vous donne pas de droits sur celle-ci. La pratique, la transcription et l’apprentissage sont très bien, mais la publication d’un remix nécessite toujours l’autorisation du propriétaire de la chanson.
Sources
- StemDeck sur GitHub (StemDeck)
- StemDeck est un séparateur de tige local open source GRATUIT (Bedroom Producers Blog)
- Séparateur de tiges StemDeck gratuit et open source pour Linux, Mac et Windows (Synthtopia)
Tencent Open-Sources Hy4, un modèle de 770 milliards de paramètres conçu pour le travail de bureau
Tencent a publié un aperçu Hy4 avec 770 milliards de paramètres au total, 49 milliards actifs et une fenêtre contextuelle supérieure à un million de jetons. La partie inhabituelle est ce pour quoi il a été optimisé : des feuilles de calcul, des documents et de longues sessions de codage.