40k Songs with Audio Features and Lyrics
Conjunto de datos multimodal que combina letras de canciones y características de audio extraídas, que abarca 79 géneros musicales y aproximadamente 43 000 títulos, ideal para proyectos de análisis musical y aprendizaje multimodal.
Alrededor de 43 000 canciones en inglés con archivos de letras (texto) y funciones de audio (CSV/JSON)
Apache 2.0
Descripción
El conjunto de datos 40 000 canciones con funciones de audio y letras reúne aproximadamente 43.000 canciones en inglés, que incluyen letras y características de audio explícitas de tres fuentes combinadas. Abarca 79 géneros musicales variados, lo que permite una rica exploración de datos musicales multimodales.
¿Para qué sirve este conjunto de datos?
- Análisis y clasificación musical en función de las letras y las características del audio
- Entrenamiento de modelos multimodales que combinan audio y texto
- Busca generando automáticamente música o letras
¿Se puede enriquecer o mejorar?
El conjunto de datos se puede complementar con anotaciones adicionales, como el estado de ánimo, el tempo o metadatos más precisos. La integración de datos de audio sin procesar completos también ampliaría su uso.
🔎 En resumen
🧠 Recomendado para
- Investigadores de música con IA
- Proyectos multimodales
- Desarrolladores de NLP + audio
🔧 Herramientas compatibles
- Librosa
- Transformers Huggging Face
- PyTorch
- TensorFlow
- Espacio Y
💡 Consejo
Pretratar cuidadosamente la voz (limpieza y tokenización) optimiza el rendimiento de los modelos multimodales.
Preguntas frecuentes
¿Qué idiomas están presentes en este conjunto de datos?
Principalmente inglés, con una amplia gama de géneros musicales.
¿Podemos usar este conjunto de datos para generar música?
Sí, especialmente para el entrenamiento de modelos multimodales que combinan audio y texto.
¿La licencia Apache 2.0 permite el uso comercial?
Sí, esta licencia es permisiva y permite un uso comercial gratuito.




