LLM Prompt Recovery Data Gemini and Gemma
Este conjunto de datos contiene pares de mensajes originales y reformulados, así como textos generados por dos sistemas: Gemini y Gemma. Su objetivo es mejorar y evaluar la capacidad de los modelos de LLM para comprender y reformular las instrucciones.
Varios cientos de ejemplos de texto en formato JSON/CSV (no especificado)
Apache 2.0
Descripción
LLM Prompt Recovery Data Gemini and Gemma recopila datos sobre las indicaciones de prueba originales, las instrucciones proporcionadas a Gemini y Gemma y los textos reescritos generados por estos dos modelos. Es un corpus útil para el análisis y la mejora de las capacidades de reformulación y generación de indicaciones.
¿Para qué sirve este conjunto de datos?
- Evalúe la calidad de la reformulación de las instrucciones utilizando modelos LLM
- Entrene a los modelos para que entiendan y reescriban las instrucciones de texto
- Mejore la generación automática de indicaciones para tareas específicas
¿Se puede enriquecer o mejorar?
Este conjunto de datos se puede complementar con anotaciones cualitativas sobre la consistencia o fidelidad de las reformulaciones, así como con datos adicionales de otros modelos para aumentar la diversidad.
🔎 En resumen
🧠 Recomendado para
- Investigadores de PNL
- Desarrolladores LLM
- Científicos de datos
🔧 Herramientas compatibles
- Hugging Face Transformers
- TensorFlow
- PyTorch
- Jupyter Notebooks
💡 Consejo
Compruebe la coherencia de las reformulaciones antes del entrenamiento para garantizar la calidad del ajuste.
Preguntas frecuentes
¿Qué tipo de datos contiene este conjunto de datos?
Indicaciones originales, instrucciones reformuladas y textos generados por dos modelos llamados Gemini y Gemma.
¿Este conjunto de datos es adecuado para entrenar modelos de reformulación?
Sí, contiene pares que son útiles para entrenar y evaluar la reformulación de las indicaciones.
¿La licencia permite el uso comercial?
Sí, la licencia Apache 2.0 permite el uso comercial y modificado.




