Parquet
1,501 results
AudioMultimodalText
echo-clones-4m-en
echo-clones-4m-en ~4 M English TTS clone utterances generated with EchoTTS (jordand/echo-tts-base). Sample rate: 44 100 Hz, 16-bit PCM…
1M–10M·Apache-2.0·Parquet
AudioMultimodalText
Multilingual MFA-Aligned Speech Dataset
Multilingual MFA-Aligned Speech Dataset
10M–100M·CC-BY·Parquet
AudioMultimodalText
irodori-clones-3m-v2-no-emoji
Irodori TTS Clones v2 (3.29M) 3,290,000 cloned utterances generated with Aratako/Irodori-TTS-500M-v2, using the 10,000 reference voices from…
1M–10M·Apache-2.0·Parquet
AudioMultimodalText
A Multilingual Speech Dataset for SLU and Beyond
A Multilingual Speech Dataset for SLU and Beyond
10K–100K·CC-BY-NC-SA·Parquet
AudioMultimodalText
LIEPA-3 Lithuanian Speech Corpus
LIEPA-3 Lithuanian Speech Corpus
1M–10M·CC-BY·Parquet
AudioMultimodalText
openwhisper
Streaming ASR Dataset This dataset is designed for training real-time (streaming) ASR models, with a focus on handling…
100K–1M·MIT·Parquet
AudioMultimodalText
IndicVoices
IndicVoices: Towards building an Inclusive Multilingual Speech Dataset for Indian Languages Updates 23 December 2025 We now have…
1M–10M·CC-BY·Parquet
AudioMultimodalText
FreeSound.org LAION-640k Dataset
FreeSound.org LAION-640k Dataset
100K–1M·Other·Parquet
AudioMultimodalText
NatureLM-audio-training
NatureLM-audio-training
10M–100M·Custom / Research-only·Parquet