Open X-Embodiment
1M+ real-robot trajectories from 20+ institutions.
Dataset Card for the image text and voice dataset Dataset Description Subset of Afrivoice dataset: approx. 100 hours of train (sampled, stratified) Full dev + test from original repo (DigitalUmuganda/Afrivoice Swahili) Audio: .webm Includes images + transcriptions from original repo (DigitalUmuganda/Afrivoice Swahili) Includes metadata csv License CC-BY-4.0 (derived from DigitalUmuganda/Afrivoice Swahili) Notes Train split sampled using… See the full description on the dataset page:
Source: Hugging Face Hub (egirma/afrivoice-swahili-agriculture-subset). Metadata imported from the dataset’s Hub tags.