Al hacer clic en "Aceptar", usted acepta que se almacenen cookies en su dispositivo para mejorar la navegación del sitio, analizar su uso y contribuir a nuestros esfuerzos de marketing. Consulte nuestra política de privacidad para más información.  pour plus d'informations.
Open Datasets
40k Songs with Audio Features and Lyrics
Multimodal

40k Songs with Audio Features and Lyrics

Conjunto de datos multimodal que combina letras de canciones y características de audio extraídas, que abarca 79 géneros musicales y aproximadamente 43 000 títulos, ideal para proyectos de análisis musical y aprendizaje multimodal.

Obtén el dataset
Tamaño

Alrededor de 43 000 canciones en inglés con archivos de letras (texto) y funciones de audio (CSV/JSON)

Licencia

Apache 2.0

Descripción

El conjunto de datos 40 000 canciones con funciones de audio y letras reúne aproximadamente 43.000 canciones en inglés, que incluyen letras y características de audio explícitas de tres fuentes combinadas. Abarca 79 géneros musicales variados, lo que permite una rica exploración de datos musicales multimodales.

¿Para qué sirve este conjunto de datos?

  • Análisis y clasificación musical en función de las letras y las características del audio
  • Entrenamiento de modelos multimodales que combinan audio y texto
  • Busca generando automáticamente música o letras

¿Se puede enriquecer o mejorar?

El conjunto de datos se puede complementar con anotaciones adicionales, como el estado de ánimo, el tempo o metadatos más precisos. La integración de datos de audio sin procesar completos también ampliaría su uso.

🔎 En resumen

Criterio Evaluación
🧩 Facilidad de uso⭐⭐⭐✩✩ (Datos tabulares fáciles de manipular, requiere procesamiento de texto y audio)
🧼 Necesidad de limpieza⭐⭐⭐⭐✩ (Moderado – uniformización de letras y características de audio necesaria)
🏷️ Riqueza de anotaciones⭐⭐⭐✩✩ (Buen equilibrio entre texto y audio, anotaciones limitadas a características extraídas)
📜 Licencia comercial✅ Sí (Apache 2.0)
👨‍💻 Ideal para principiantes⚠️ Medio, requiere conocimientos en procesamiento de audio y NLP
🔁 Reutilizable para fine-tuning🎵 Muy adecuado para fine-tuning multimodal
🌍 Diversidad cultural🎭 Buena diversidad gracias a los 79 géneros musicales

🧠 Recomendado para

  • Investigadores de música con IA
  • Proyectos multimodales
  • Desarrolladores de NLP + audio

🔧 Herramientas compatibles

  • Librosa
  • Transformers Huggging Face
  • PyTorch
  • TensorFlow
  • Espacio Y

💡 Consejo

Pretratar cuidadosamente la voz (limpieza y tokenización) optimiza el rendimiento de los modelos multimodales.

Preguntas frecuentes

¿Qué idiomas están presentes en este conjunto de datos?

Principalmente inglés, con una amplia gama de géneros musicales.

¿Podemos usar este conjunto de datos para generar música?

Sí, especialmente para el entrenamiento de modelos multimodales que combinan audio y texto.

¿La licencia Apache 2.0 permite el uso comercial?

Sí, esta licencia es permisiva y permite un uso comercial gratuito.

Otros datasets

Ver más
Category

Lorem ipsum dolor sit amet, consectetur adipiscing elit. Suspendisse varius enim in eros elementum tristique.

Category

Lorem ipsum dolor sit amet, consectetur adipiscing elit. Suspendisse varius enim in eros elementum tristique.

Category

Lorem ipsum dolor sit amet, consectetur adipiscing elit. Suspendisse varius enim in eros elementum tristique.