Parquet
1,501 results
pusht
This dataset was created using LeRobot. Dataset Structure meta/info.json: { "codebase version": "v2.0", "robot type": "unknown", "total episodes":…
abc_130k_v3_train
This dataset was created using LeRobot. Dataset Structure meta/info.json: { "codebase version": "v3.0", "fps": 30, "features": { "observation.state":…
droid_1.0.1
This dataset was created using LeRobot. Dataset Structure meta/info.json: { "codebase version": "v3.0", "robot type": "Franka", "total episodes":…
MolmoAct2-BimanualYAM-Dataset
This dataset was created using LeRobot. MolmoAct2-BimanualYAM Dataset This repository is the merged ckpt / merged LeRobot dataset…
libritts
Dataset Card for LibriTTS LibriTTS is a multi-speaker English corpus of approximately 585 hours of read English speech…
FalAR
FalAR FalAR is a large-scale, speaker-annotated European Portuguese speech corpus built from recordings of parliamentary sessions of the…
esc50
The dataset is available under the terms of the Creative Commons Attribution Non-Commercial license. K. J. Piczak. ESC:…
EuroSpeech-24kHz
EuroSpeech 24 kHz Dataset Dataset Description EuroSpeech is a large-scale multilingual speech corpus containing high-quality aligned parliamentary…
Multilingual MFA-Aligned Speech Dataset
Multilingual MFA-Aligned Speech Dataset
reazon-speech-v2-denoised-same-speaker-pair
Reazon Speech v2 DENOISED Same Speaker Pair prj-beatrice/reazon-speech-v2-denoised-titanet-embeddings のコサイン類似度の総和がなるべく大きくなるように…
Tarteel AI – EveryAyah Dataset
Tarteel AI - EveryAyah Dataset
avspeech-visual-audio
AVSpeech Video + Audio A restructured subset of the AVSpeech dataset with separated media streams and derived identifiers.…