Datasets
1,940 results
a novel large-scale Vietnamese speech corpus (LSVSC)
a novel large-scale Vietnamese speech corpus (LSVSC)
SimbaBench_dataset
SibmaBench Data Release & Benchmarking To evaluate your model on SimbaBench across all supported tasks (ASR, TTS, and…
enhanced-audiosnippets-long-2-8M
Enhanced Audiosnippets Long 2.8M Enhanced version of mitermix/audiosnippets long 2 8M with speech enhancement, emotion annotations, speaker…
SpeechJudge-Data
SpeechJudge-Data: A Large-Scale Human Feedback Corpus for Speech Generation Introduction SpeechJudge-Data is a large-scale human feedback corpus of…
moore_audio_data
~70h of Mooré paired audio+text data from jw.org and jwsoup Headers: audio, text
Chinese Conversational TTS Text (10M)
Chinese Conversational TTS Text (10M)
Uzbek YouTube Speech Dataset
Uzbek YouTube Speech Dataset
NaturalVoices Restored (48 kHz, Sidon + UTMOS-filtered)
NaturalVoices Restored (48 kHz, Sidon + UTMOS-filtered)
TTS Punctuation Vocal Commands FR
TTS Punctuation Vocal Commands FR
Arabic Diacritized-Stem Lexicon
Arabic Diacritized-Stem Lexicon
Open Bible Resources — African Languages
Open Bible Resources — African Languages
C3T
C3T: Cross-modal Capabilities Conservation Test Dataset Description C3T (Cross-modal Capabilities Conservation Test) is a benchmark for assessing the…
Dialogs: Expressive Conversational Russian Speech Corpus
Dialogs: Expressive Conversational Russian Speech Corpus
Urdu-ONYX-WAV-kanade-Annotated
Urdu-ONYX-WAV-real-Annotated Enhanced version of Urdu-ONYX-WAV-real with phoneme annotations and Kanade tokenizer features. Dataset Statistics Total…
moss-character-voices-bestof64
MOSS Character Voices — Best-of-64 (Stage 2) Best-of-64 voice-acting takes from the 4.55B MOSS-TTS-Local voice-acting model…