Gated
293 results
ivrit.ai – Knesset Plenums Whisper Training
ivrit.ai - Knesset Plenums Whisper Training
Sunbird African Language Technology (SALT) dataset
Sunbird African Language Technology (SALT) dataset
VieNeu-TTS-140h
pnnbao-ump/VieNeu-TTS-140h Mô tả Dataset A high-quality Vietnamese Text-to-Speech (TTS) dataset containing 74,858 audio samples with phonemized…
WorldAudioNaturalConversations Sample Dataset
WorldAudioNaturalConversations Sample Dataset
SynParaSpeech
Description Here is the SynParaSpeech dataset. SynParaSpeech is the first automated synthesis framework for constructing large-scale paralinguistic…
cantonese-youtube-tts
Cantonese Audio TTS Dataset This dataset contains alvanlii/cantonese-radio, alvanlii/cantonese-youtube, plus a dataset of equal size. It is catered…
Mimba PLT TTS Dataset (Plateau Malagasy Synthetic Speech)
Mimba PLT TTS Dataset (Plateau Malagasy Synthetic Speech)
Emilia-NV
NVSpeech Dataset Overview The NVSpeech dataset provides extensive annotations of paralinguistic vocalizations for Mandarin Chinese speech, aimed at…
MintTTS Pre-tokenized Audio (somu9/hindi-hq)
MintTTS Pre-tokenized Audio (somu9/hindi-hq)
vaja-thai
Vaja-Thai (วาจา) — Combined Thai TTS Dataset A unified, quality-filtered Thai speech dataset combining multiple sources for Text-to-Speech…
alconost-multilingual-speech-gold
Multilingual Speech & Translation Dataset — EN↔JA/AR-EG/PL/RU (10 phrases, dual-take) Description 10 English source phrases with expert human…
SpeechJudge-Data
SpeechJudge-Data: A Large-Scale Human Feedback Corpus for Speech Generation Introduction SpeechJudge-Data is a large-scale human feedback corpus of…
moore_audio_data
~70h of Mooré paired audio+text data from jw.org and jwsoup Headers: audio, text
viVoice: Enabling Vietnamese Multi-Speaker Speech Synthesis
viVoice: Enabling Vietnamese Multi-Speaker Speech Synthesis
INTP
INTP: Intelligibility Preference Speech Dataset We establish a synthetic Intelligibility Preference Speech Dataset (INTP), including about 250K…
SPS-Bopha-Voice-Dataset-v1
VibeVoice Fine-Tuning Dataset: SPS-Bopha-Voice-Dataset-v1 This dataset is formatted for fine-tuning VibeVoice. Structure training data.jsonl: The…