Common Voice – Corpus audio pour reconnaissance vocale
Common Voice est un corpus audio communautaire, comprenant des milliers d’enregistrements vocaux accompagnés de leurs transcriptions textuelles. Le dataset sert principalement à l’entraînement et à l’évaluation de systèmes de reconnaissance vocale automatique (ASR).
Plusieurs milliers de fichiers audio MP3 accompagnés de fichiers CSV de métadonnées, multilingue
CC0: Public Domain
Description
Le dataset Common Voice contient des milliers de fichiers audio MP3 accompagnés de transcriptions validées par plusieurs auditeurs. Il est divisé en ensembles d’entraînement, de développement et de test, avec métadonnées détaillées sur l’âge, le genre, l’accent et la qualité de chaque enregistrement.
À quoi sert ce dataset ?
- Entraîner des modèles ASR robustes sur des données vocales diverses
- Évaluer la reconnaissance vocale selon des critères démographiques et linguistiques
- Effectuer du fine-tuning sur des voix spécifiques ou langues variées
Peut-on l’enrichir ou l’améliorer ?
Oui, ce corpus est ouvert à la contribution communautaire via la plateforme Common Voice. Les annotations peuvent être affinées par validation supplémentaire et les langues étendues. Des métadonnées additionnelles peuvent également être ajoutées pour améliorer les cas d’usage.
🔎 En résumé
🧠 Recommandé pour
- Chercheurs en reconnaissance vocale
- Développeurs ASR
- Projets multilingues
🔧 Outils compatibles
- Kaldi
- ESPnet
- Hugging Face Transformers
- PyTorch
- TensorFlow
💡 Astuce
Sélectionnez les sous-ensembles validés pour un entraînement optimal et fiable.
Questions fréquemment posées
Quelles langues sont couvertes par Common Voice ?
Common Voice couvre de nombreuses langues et accents, avec une forte présence de l’anglais, mais aussi d’autres langues en fonction des contributions.
Les fichiers audio sont-ils tous validés ?
Seuls les fichiers des ensembles “valid” ont été validés par plusieurs auditeurs, garantissant la correspondance audio-texte.
Peut-on contribuer à ce dataset ?
Oui, Common Voice est un projet communautaire ouvert où chacun peut enregistrer et valider des clips audio pour enrichir le corpus.




