MRSDrama
ISDrama: Immersive Spatial Drama Generation through Multimodal Prompting Yu Zhang , Wenxiang Guo , Changhao Pan , Zhiyuan…
312 results
ISDrama: Immersive Spatial Drama Generation through Multimodal Prompting Yu Zhang , Wenxiang Guo , Changhao Pan , Zhiyuan…
Sagalee: An Open Source ASR Dataset for Oromo Language
Ghana TTS Navigation Corpus (Dagbani)
SynDataLab/Irodori-Ja-Spk1-10k 10,000 single-speaker conversational Japanese utterances synthesized with Irodori-TTS-500M-v2. Part of a 4-speaker…
Contribution This dataset is a processed version of the original LibriTTS-P dataset, optimized for use on the Hugging…
Sunbird African Language Technology (SALT) dataset
pnnbao-ump/VieNeu-TTS-140h Mô tả Dataset A high-quality Vietnamese Text-to-Speech (TTS) dataset containing 74,858 audio samples with phonemized…
WorldAudioNaturalConversations Sample Dataset
Dataset Audio Russian Backup This is a backup dataset with Russian audio data, split into train 0 to…
Speech DAC Tokens (3 Codebooks)
Dataset Card for LibriTTS-R LibriTTS-R 1 is a sound quality improved version of the LibriTTS corpus ( which…
Quran-Recitations Dataset Overview The Quran-Recitations dataset is a rich and reverent collection of Quranic verses, meticulously paired with…
Multilingual Synthetic TTS (Qwen3)
Ghana TTS Navigation Corpus (Ewe)
Description Here is the SynParaSpeech dataset. SynParaSpeech is the first automated synthesis framework for constructing large-scale paralinguistic…
Turkish Neural Voice Dataset
Nav-train-gnjr-s-t-t Persian speech dataset. Audio resampled to 16000 Hz. Splits Split Samples Total Duration (H:MM:SS) Volume train 160931…