40k Songs with Audio Features and Lyrics
Dataset multimodal combinant paroles de chansons et caractéristiques audio extraites, couvrant 79 genres musicaux et environ 43 000 titres, idéal pour projets d’analyse musicale et apprentissage multimodal.
Environ 43 000 chansons en anglais avec fichiers de paroles (texte) et features audio (CSV/JSON)
Apache 2.0
Description
Le dataset 40k Songs with Audio Features and Lyrics rassemble environ 43 000 chansons en anglais, incluant leurs paroles ainsi que des caractéristiques audio explicites issues de trois sources combinées. Il couvre 79 genres musicaux variés, permettant une exploration riche des données musicales multimodales.
À quoi sert ce dataset ?
- Analyse et classification musicale basée sur les paroles et les caractéristiques audio
- Entraînement de modèles multimodaux combinant audio et texte
- Recherche en génération automatique de musique ou de paroles
Peut-on l’enrichir ou l’améliorer ?
Le dataset peut être complété par des annotations supplémentaires telles que l’humeur, le tempo, ou des métadonnées plus précises. L’intégration de données audio brutes complètes permettrait aussi d’élargir son usage.
🔎 En résumé
🧠 Recommandé pour
- Chercheurs en musique IA
- Projets multimodaux
- Développeurs NLP + audio
🔧 Outils compatibles
- Librosa
- Hugging Face Transformers
- PyTorch
- TensorFlow
- SpaCy
💡 Astuce
Prétraiter soigneusement les paroles (nettoyage et tokenisation) optimise les performances des modèles multimodaux.
Questions fréquemment posées
Quelles langues sont présentes dans ce dataset ?
Principalement l’anglais, avec une large couverture de genres musicaux.
Peut-on utiliser ce dataset pour générer de la musique ?
Oui, notamment pour l’entraînement de modèles multimodaux combinant audio et texte.
La licence Apache 2.0 permet-elle un usage commercial ?
Oui, cette licence est permissive et permet une utilisation commerciale libre.




