En cliquant sur "Accepter ", vous acceptez que des cookies soient stockés sur votre appareil afin d'améliorer la navigation sur le site, d'analyser son utilisation et de contribuer à nos efforts de marketing. Consultez notre politique de confidentialité pour plus d'informations.
Open Datasets
Common Voice – Corpus audio pour reconnaissance vocale
Audio

Common Voice – Corpus audio pour reconnaissance vocale

Common Voice est un corpus audio communautaire, comprenant des milliers d’enregistrements vocaux accompagnés de leurs transcriptions textuelles. Le dataset sert principalement à l’entraînement et à l’évaluation de systèmes de reconnaissance vocale automatique (ASR).

Télécharger le dataset
Taille

Plusieurs milliers de fichiers audio MP3 accompagnés de fichiers CSV de métadonnées, multilingue

Licence

CC0: Public Domain

Description

Le dataset Common Voice contient des milliers de fichiers audio MP3 accompagnés de transcriptions validées par plusieurs auditeurs. Il est divisé en ensembles d’entraînement, de développement et de test, avec métadonnées détaillées sur l’âge, le genre, l’accent et la qualité de chaque enregistrement.

À quoi sert ce dataset ?

  • Entraîner des modèles ASR robustes sur des données vocales diverses
  • Évaluer la reconnaissance vocale selon des critères démographiques et linguistiques
  • Effectuer du fine-tuning sur des voix spécifiques ou langues variées

Peut-on l’enrichir ou l’améliorer ?

Oui, ce corpus est ouvert à la contribution communautaire via la plateforme Common Voice. Les annotations peuvent être affinées par validation supplémentaire et les langues étendues. Des métadonnées additionnelles peuvent également être ajoutées pour améliorer les cas d’usage.

🔎 En résumé

Critère Évaluation
🧩Facilité d’utilisation ⭐⭐⭐⭐☆ (métadonnées complètes, nécessite gestion des fichiers audio)
🧼Besoin de nettoyage ⭐⭐⭐⭐☆ (faible à modéré selon usage, clips invalides séparés)
🏷️Richesse des annotations ⭐⭐⭐⭐☆ (transcriptions validées, métadonnées démographiques)
📜Licence commerciale ✅ Oui (CC0)
👨‍💻Idéal pour les débutants 👨‍🎓 Oui, pour projets ASR avec guidage adapté
🔁Réutilisable en fine-tuning 🔥 Parfait pour adaptation voix et accents
🌍Diversité culturelle 🌍 Large diversité d’âges, genres et accents

🧠 Recommandé pour

  • Chercheurs en reconnaissance vocale
  • Développeurs ASR
  • Projets multilingues

🔧 Outils compatibles

  • Kaldi
  • ESPnet
  • Hugging Face Transformers
  • PyTorch
  • TensorFlow

💡 Astuce

Sélectionnez les sous-ensembles validés pour un entraînement optimal et fiable.

Questions fréquemment posées

Quelles langues sont couvertes par Common Voice ?

Common Voice couvre de nombreuses langues et accents, avec une forte présence de l’anglais, mais aussi d’autres langues en fonction des contributions.

Les fichiers audio sont-ils tous validés ?

Seuls les fichiers des ensembles “valid” ont été validés par plusieurs auditeurs, garantissant la correspondance audio-texte.

Peut-on contribuer à ce dataset ?

Oui, Common Voice est un projet communautaire ouvert où chacun peut enregistrer et valider des clips audio pour enrichir le corpus.

Datasets similaires

Voir plus
Category

Lorem ipsum dolor sit amet, consectetur adipiscing elit. Suspendisse varius enim in eros elementum tristique.

Category

Lorem ipsum dolor sit amet, consectetur adipiscing elit. Suspendisse varius enim in eros elementum tristique.

Category

Lorem ipsum dolor sit amet, consectetur adipiscing elit. Suspendisse varius enim in eros elementum tristique.