En cliquant sur "Accepter ", vous acceptez que des cookies soient stockés sur votre appareil afin d'améliorer la navigation sur le site, d'analyser son utilisation et de contribuer à nos efforts de marketing. Consultez notre politique de confidentialité pour plus d'informations.
Open Datasets
SVLA SO100 Sorting Dataset
Video

SVLA SO100 Sorting Dataset

Dataset multimodal combinant séquences vidéo et données robotiques détaillées issues d’un robot SO100. Il inclut des vidéos HD à 30fps ainsi que des données d’action et d’état du robot, permettant d’étudier et modéliser la manipulation d’objets par vision et commandes.

Télécharger le dataset
Taille

18 vidéos (480x640, 30fps, codec AV1), 6633 frames, données d’actions et d’observations au format parquet

Licence

Apache 2.0

Description

Le dataset SVLA SO100 Sorting Dataset contient 18 vidéos HD (480x640, 30 fps) enregistrées avec un robot SO100, accompagnées de données d’action (six degrés de liberté) et d’observation. Les données sont organisées en épisodes et chunks avec métadonnées détaillées.

À quoi sert ce dataset ?

  • Développer et entraîner des modèles vision-langage-action en robotique.
  • Analyser les mouvements et interactions robotisées pour des tâches de tri et manipulation.
  • Tester des algorithmes d’apprentissage multimodal intégrant vidéo et données capteurs.

Peut-on l’enrichir ou l’améliorer ?

Ce dataset peut être enrichi par l’ajout de nouvelles séquences vidéo, annotations supplémentaires sur les actions, ou extensions vers d’autres types de robots ou tâches. La précision des données d’état peut aussi être augmentée par annotation fine.

🔎 En résumé

Critère Évaluation
🧩 Facilité d’utilisation⭐⭐⭐✩✩ (Nécessite traitement vidéo et données capteurs parquet)
🧼 Besoin de nettoyage⭐⭐⭐⭐✩ (Modéré – format structuré mais multiformat à gérer)
🏷️ Richesse des annotations⭐⭐⭐⭐✩ (Bonne – données d’actions détaillées et métadonnées)
📜 Licence commerciale✅ Oui (Apache 2.0)
👨‍💻 Idéal pour les débutants⚠️ Moyennement – format vidéo et capteurs à maîtriser
🔁 Réutilisable en fine-tuning🎯 Adapté pour apprentissage multimodal en robotique
🌍 Diversité culturelle⚖️ Contenu technique sans biais culturel notable

🧠 Recommandé pour

  • Chercheurs en robotique
  • Développeurs IA multimodale
  • Équipes R&D vision-action

🔧 Outils compatibles

  • Frameworks vidéo (OpenCV, FFmpeg)
  • Outils parquet
  • Bibliothèques robotique (ROS)

💡 Astuce

Synchronisez bien les vidéos et données capteurs pour un entraînement multimodal efficace.

Questions fréquemment posées

Quelle est la résolution et le format des vidéos du dataset ?

Les vidéos sont en 480x640 pixels, 30 images par seconde, encodées en codec AV1 sans audio.

Quelles données d’actions sont fournies avec les vidéos ?

Six degrés de liberté sont capturés : mouvements d’épaule, coude, poignet et ouverture du préhenseur.

Ce dataset convient-il pour un apprentissage supervisé ou renforcement ?

Principalement pour apprentissage supervisé multimodal, mais peut être adapté pour renforcement avec données additionnelles.

Datasets similaires

Voir plus
Category

Lorem ipsum dolor sit amet, consectetur adipiscing elit. Suspendisse varius enim in eros elementum tristique.

Category

Lorem ipsum dolor sit amet, consectetur adipiscing elit. Suspendisse varius enim in eros elementum tristique.

Category

Lorem ipsum dolor sit amet, consectetur adipiscing elit. Suspendisse varius enim in eros elementum tristique.