Text-to-Speech
312 results
Kazakh Traditional Audio Archive
Kazakh Traditional Audio Archive
SPS-Bopha-Voice-Dataset-v1
VibeVoice Fine-Tuning Dataset: SPS-Bopha-Voice-Dataset-v1 This dataset is formatted for fine-tuning VibeVoice. Structure training data.jsonl: The…
Quranic Translation Audio Data
Quranic Translation Audio Data
Talker-T2AV-Data
Talker-T2AV-Data Joint Talking Audio-Video Generation with Autoregressive Diffusion Modeling Paper (arXiv 2604.23586) · Code (GitHub) · Model ·…
open-swara
Open Swara The largest open-source humanized voice library -- 4,065 voice samples across 44 languages, free forever under…
libritts
Dataset Card for LibriTTS LibriTTS is a multi-speaker English corpus of approximately 585 hours of read English speech…
Multilingual MFA-Aligned Speech Dataset
Multilingual MFA-Aligned Speech Dataset
reazon-speech-v2-denoised-same-speaker-pair
Reazon Speech v2 DENOISED Same Speaker Pair prj-beatrice/reazon-speech-v2-denoised-titanet-embeddings のコサイン類似度の総和がなるべく大きくなるように…
Quranic Recitation Dataset (Word-by-Word)
Quranic Recitation Dataset (Word-by-Word)
ASMR-Archive-Processed-SFW
ASMR-Archive-Processed-SFW
libritts_r
Dataset Card for LibriTTS-R LibriTTS-R 1 is a sound quality improved version of the LibriTTS corpus ( which…
Bengali Telecom Customer Care Synthetic Speech v2
Bengali Telecom Customer Care Synthetic Speech v2
AISHELL-3
AISHELL-3 is a large-scale and high-fidelity multi-speaker Mandarin speech corpus published by Beijing Shell Shell Technology Co.,Ltd. It…
cml-tts-filtered
Dataset Card for Filtred and CML-TTS This dataset is a filtred version of a CML-TTS 1 . CML-TTS…