dutch-tts-labeled-complete
Dutch TTS Dataset - Complete Labeled A comprehensive Dutch text-to-speech dataset with 596,508 audio samples totaling 234GB of…
1,117 results
Dutch TTS Dataset - Complete Labeled A comprehensive Dutch text-to-speech dataset with 596,508 audio samples totaling 234GB of…
Dataset Card for Filtred and annotated CML TTS This dataset is an annotated and filtred version of a…
Dataset Card for Annotations of non English MLS This dataset consists in annotations of a the Non English…
Risale-i Nur Sesli Külliyat — Risale-i Nur Audio Corpus
MintTTS Pre-tokenized Audio (somu9/hindi-hq)
UniST This dataset contains UniST codec-token training data exported from local metadata and codec results. We train UniSS…
VoxCPM Ghana — Precomputed AudioVAE Latents
Use this dataset in conjuction with: YodasSpeakerPool YodasSpeakerPool is a curated, richly-annotated multi-speaker dataset featuring 7,600 unique…
OpenSTT annotate by Balalaika
Dataset Card for MusicCaps Dataset Summary The MusicCaps dataset contains 5,521 music examples, each of which is labeled…
Enhanced Audiosnippets Long 2.8M Enhanced version of mitermix/audiosnippets long 2 8M with speech enhancement, emotion annotations, speaker…
Arabic Diacritized-Stem Lexicon
Urdu-ONYX-WAV-real-Annotated Enhanced version of Urdu-ONYX-WAV-real with phoneme annotations and Kanade tokenizer features. Dataset Statistics Total…
MOSS Character Voices — Best-of-64 (Stage 2) Best-of-64 voice-acting takes from the 4.55B MOSS-TTS-Local voice-acting model…
Talker-T2AV-Data Joint Talking Audio-Video Generation with Autoregressive Diffusion Modeling Paper (arXiv 2604.23586) · Code (GitHub) · Model ·…
NutriDermAI Dataset Dataset for NutriDermAI — Multimodal AI System for Dermatology with ABCDE Explainability and VQA. M.Tech Thesis…
🌍 GeoMeld Multi-Modal Earth Observation Dataset (WebDataset) GeoMeld is a large-scale multi-modal remote sensing dataset introduced in our…
Synthetic Inline Holographical Images v3 (224px Highly Diverse)