SpeechJudge-Data
SpeechJudge-Data: A Large-Scale Human Feedback Corpus for Speech Generation Introduction SpeechJudge-Data is a large-scale human feedback corpus of…
514 results
SpeechJudge-Data: A Large-Scale Human Feedback Corpus for Speech Generation Introduction SpeechJudge-Data is a large-scale human feedback corpus of…
~70h of Mooré paired audio+text data from jw.org and jwsoup Headers: audio, text
Uzbek YouTube Speech Dataset
NaturalVoices Restored (48 kHz, Sidon + UTMOS-filtered)
TTS Punctuation Vocal Commands FR
Google LATAM Spanish Female Speech with Normalized Boundary Silence
Open Bible Resources — African Languages
C3T: Cross-modal Capabilities Conservation Test Dataset Description C3T (Cross-modal Capabilities Conservation Test) is a benchmark for assessing the…
Dialogs: Expressive Conversational Russian Speech Corpus
QuranLab — Qur'an Recitation Audio: Reference Manifest & CC-BY Word Timing
Phoneme-labelled Quran Datatset This dataset contains recitations from 45 professional Quran reciters, sourced from EveryAyah and QUL. The…
Emolia-Thinking — Balanced Per-Dimension Bucket Subset A balanced, per-dimension bucket subset of VoiceNet/emolia-thinking, derived from that…
viVoice: Enabling Vietnamese Multi-Speaker Speech Synthesis