Al hacer clic en "Aceptar", usted acepta que se almacenen cookies en su dispositivo para mejorar la navegación del sitio, analizar su uso y contribuir a nuestros esfuerzos de marketing. Consulte nuestra política de privacidad para más información.  pour plus d'informations.
Open Datasets
S&P 500 Earnings Transcripts
Texto

S&P 500 Earnings Transcripts

Un corpus completo de transcripciones financieras trimestrales de compañías del S&P 500 a lo largo de 20 años, ideal para el análisis semántico, temporal y estratégico.

Obtén el dataset
Tamaño

33.362 transcripciones de texto estructurado por orador, formato JSON

Licencia

MIT

Descripción

‍

El conjunto de datos S&P 500 Earnings Transcripts reúne más de 33 000 transcripciones de llamadas financieras trimestrales de 685 empresas estadounidenses del S&P 500, que abarcan el período 2005-2025. Cada convocatoria está estructurada por orador, lo que ofrece una base rica para el trabajo de la PNL aplicado a la financiación y al análisis de los diálogos económicos.

‍

‍

¿Para qué sirve este conjunto de datos?

‍

  • Análisis de la confianza del mercado a través de declaraciones ejecutivas
  • Entrene modelos resumidos automáticos para un contenido económico extenso
  • Creación de modelos especializados para la respuesta a preguntas financieras o la detección de señales débiles

‍

‍

¿Se puede enriquecer o mejorar?

‍

Sí, este corpus se puede enriquecer con anotaciones de tono, etiquetas temáticas (finanzas, crecimiento, riesgo) o enlaces a datos bursátiles para correlacionarlos. También es posible combinar las transcripciones con modelos de voz para alinearlas entre el audio y el texto.

‍

‍

🔎 En resumen

Criterio Evaluación
🧩 Facilidad de uso⭐⭐⭐⭐✩ (Estructurado por participante y trimestre)
🧼 Necesidad de limpieza⭐⭐⭐⭐⭐ (Bajo – transcripciones textuales ya formateadas)
🏷️ Riqueza de anotaciones⭐⭐⭐⭐✩ (Bueno – participantes, fecha, empresa, metadatos completos)
📜 Licencia comercial✅ Sí (MIT)
👨‍💻 Ideal para principiantes🌟 Sí – no requiere procesamiento complejo inicial
🔁 Reutilizable para fine-tuning🎯 Sí – adecuado para LLMs especializados en finanzas/lenguaje formal
🌍 Diversidad cultural⚠️ Limitado al contexto económico norteamericano

‍

‍

🧠 Recomendado para

  • Analistas de PNL
  • Investigadores de finanzas cuantitativas
  • Proyectos resumidos automáticos

‍

‍

🔧 Herramientas compatibles

  • LangChain
  • SpaCy
  • LlamaIndex
  • Hugging Face Transformers
  • Haystack

‍

‍

💡 Consejo

Utilice la estructura de las partes interesadas para capacitar a un modelo de clasificación de roles (CEO, CFO, analista).

Preguntas frecuentes

¿Este conjunto de datos solo cubre las empresas del S&P 500?

No, también incluye otras grandes capitalizaciones estadounidenses además de las empresas del S&P 500.

¿El contenido es adecuado para una plantilla de resumen automática?

Sí, la riqueza del texto y la estructura clara por orador lo hacen ideal para la formación de modelos de resúmenes financieros.

¿Se puede cruzar este conjunto de datos con los datos del mercado de valores?

Sí, cada archivo contiene información sobre el tiempo y la empresa que facilita la unión con otras bases de datos.

Otros datasets

Ver más
Category

Lorem ipsum dolor sit amet, consectetur adipiscing elit. Suspendisse varius enim in eros elementum tristique.

Category

Lorem ipsum dolor sit amet, consectetur adipiscing elit. Suspendisse varius enim in eros elementum tristique.

Category

Lorem ipsum dolor sit amet, consectetur adipiscing elit. Suspendisse varius enim in eros elementum tristique.