Al hacer clic en "Aceptar", usted acepta que se almacenen cookies en su dispositivo para mejorar la navegación del sitio, analizar su uso y contribuir a nuestros esfuerzos de marketing. Consulte nuestra política de privacidad para más información.  pour plus d'informations.
Open Datasets
PhilPapers Papers Summarized Labeled
Texto

PhilPapers Papers Summarized Labeled

Conjunto de datos de texto que contiene 3.776 artículos filosóficos con resúmenes generados por el LLM y clasificación multietiqueta en 17 escuelas de filosofía.

Obtén el dataset
Tamaño

3.776 documentos en formato JSON, incluidos títulos, resúmenes y etiquetas multietiqueta

Licencia

MIT

Descripción

PhilPapers Papers Summarized Labeled es un conjunto de datos compuesto por 3.776 documentos filosóficos de PhilPapers. Cada documento contiene el título, un resumen resumido de 2 a 3 oraciones generadas por un máster en derecho y una clasificación multietiqueta en 17 escuelas filosóficas diferentes, como el existencialismo, el estoicismo o el utilitarismo.

¿Para qué sirve este conjunto de datos?

  • Entrene modelos de clasificación de etiquetas múltiples en textos académicos
  • Desarrollar herramientas de resumen automáticas en el campo filosófico
  • Analice y explore las tendencias en las escuelas de pensamiento a través de documentos

¿Se puede enriquecer o mejorar?

Sí, es posible agregar más idiomas, mejorar los resúmenes con modelos más nuevos o completar anotaciones con subcategorías más precisas.

🔎 En resumen

Criterio Evaluación
🧩 Facilidad de uso⭐⭐⭐⭐⭐ (Formato JSON claro y bien estructurado)
🧼 Necesidad de limpieza⭐⭐⭐⭐⭐ (Bajo, datos bien preparados)
🏷️ Riqueza de anotaciones⭐⭐⭐⭐⭐ (Clasificación multi-etiqueta detallada sobre 17 escuelas filosóficas)
📜 Licencia comercial✅ Sí (MIT)
👨‍💻 Ideal para principiantes⚠️ Adecuado para investigadores y estudiantes en NLP
🔁 Reutilizable para fine-tuning🎯 Perfecto para clasificación y resumen automático
🌍 Diversidad cultural🌏 Enfocado en filosofía occidental y asiática

🧠 Recomendado para

  • Investigadores de PNL
  • Estudiantes de filosofía
  • Desarrolladores de herramientas académicas

🔧 Herramientas compatibles

  • Hugging Face Datasets
  • Scikit-learn
  • PyTorch
  • Transformers

💡 Consejo

Utilice la clasificación de etiquetas múltiples para entrenar modelos que puedan tratar temas complejos y múltiples en un solo documento.

Preguntas frecuentes

¿Cuál es el formato de los resúmenes que se proporcionan en este conjunto de datos?

Los resúmenes son oraciones cortas (de 2 a 3 oraciones) generadas automáticamente por un LLM.

¿Se puede usar este conjunto de datos para la clasificación de etiquetas múltiples?

Sí, contiene etiquetas múltiples para 17 escuelas filosóficas.

¿Se pueden agregar otras categorías filosóficas al conjunto de datos?

Sí, el conjunto de datos se puede enriquecer con anotaciones adicionales o subcategorías más precisas.

Otros datasets

Ver más
Category

Lorem ipsum dolor sit amet, consectetur adipiscing elit. Suspendisse varius enim in eros elementum tristique.

Category

Lorem ipsum dolor sit amet, consectetur adipiscing elit. Suspendisse varius enim in eros elementum tristique.

Category

Lorem ipsum dolor sit amet, consectetur adipiscing elit. Suspendisse varius enim in eros elementum tristique.