droid_1.0.1
This dataset was created using LeRobot. Dataset Structure meta/info.json: { "codebase version": "v3.0", "robot type": "Franka", "total episodes":…
169 results
This dataset was created using LeRobot. Dataset Structure meta/info.json: { "codebase version": "v3.0", "robot type": "Franka", "total episodes":…
This dataset was created using LeRobot. MolmoAct2-BimanualYAM Dataset This repository is the merged ckpt / merged LeRobot dataset…
EuroSpeech 24 kHz Dataset Dataset Description EuroSpeech is a large-scale multilingual speech corpus containing high-quality aligned parliamentary…
Multilingual MFA-Aligned Speech Dataset
Speech Recognition Alignment Dataset
MLS-Sidon Overview This dataset is a cleansed version of Multilingual LibriSpeech (MLS) with Sidon speech restoration mode for…
Multilingual MFA-Aligned Speech Dataset
Multilingual MFA-Aligned Speech Dataset
CV22-Sidon Overview This dataset hosts a release of Mozilla Common Voice 22 restored with the Sidon speech restoration…
NatureLM-audio-training
X-Voice Training Dataset Overview The X-Voice training dataset is a large-scale multilingual speech corpus curated for high-performance speech…
HIW-500: Humanoids In-the-Wild Dataset (LeRobot)
This is a set of wildcards for danbooru tags. Artist:Prompts for random artist styles, covering approximately 0.6M different…
Spotify Huge Track Analysis Dataset
Multitask-National-Speech-Corpus (MNSC v1) is derived from IMDA's NSC Corpus. MNSC is a multitask speech understanding dataset derived and…
EuroSpeech Dataset Dataset Description EuroSpeech is a large-scale multilingual speech corpus containing high-quality aligned parliamentary speech…