Gated
293 results
Audio
Voice “Cloning” is Style Transfer — Audio Dataset
Voice "Cloning" is Style Transfer — Audio Dataset
10K–100K·CC-BY-NC·Audio (folder)
Audio
MLAAD: The Multi-Language Audio Anti-Spoofing Dataset
MLAAD: The Multi-Language Audio Anti-Spoofing Dataset
100K–1M·CC-BY-NC
AudioMultimodalTabular
Crowd Recital Yiddish – Source Dataset
Crowd Recital Yiddish - Source Dataset
1K–10K·Custom / Research-only·CSV
AudioMultimodalText
VoxSafeBench
VoxSafeBench Demopage: demopage/ Code: This dataset is uploaded as raw files (JSONL + audio), not parquet. Subset: Safety-tier1…
1K–10K·Apache-2.0·JSON
ImageMultimodalVideo
GOKU-2M
Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing GOKU-2M is a large-scale, unified instruction-based…
1M–10M·CC-BY-NC
ImageMultimodalText
hle
!NOTE IMPORTANT: Please help us protect the integrity of this benchmark by not publicly sharing, re-uploading, or distributing…
1K–10K·MIT·Parquet
Video
10Kh-RealOmin-OpenData
Boasting over 13,000 hours of cumulative data and 5 million+ clips, it ranks as the largest open-source embodied…
>1B·CC-BY-SA