100K–1M
595 results
libritts_p_dataset_20250821_095157
Contribution This dataset is a processed version of the original LibriTTS-P dataset, optimized for use on the Hugging…
audio_data_russian_backup
Dataset Audio Russian Backup This is a backup dataset with Russian audio data, split into train 0 to…
Speech DAC Tokens (3 Codebooks)
Speech DAC Tokens (3 Codebooks)
libritts_r
Dataset Card for LibriTTS-R LibriTTS-R 1 is a sound quality improved version of the LibriTTS corpus ( which…
Quran-Recitations
Quran-Recitations Dataset Overview The Quran-Recitations dataset is a rich and reverent collection of Quranic verses, meticulously paired with…
Turkish Neural Voice Dataset
Turkish Neural Voice Dataset
Nav-train-gnjr-s-t-t
Nav-train-gnjr-s-t-t Persian speech dataset. Audio resampled to 16000 Hz. Splits Split Samples Total Duration (H:MM:SS) Volume train 160931…
dutch-tts-labeled-complete
Dutch TTS Dataset - Complete Labeled A comprehensive Dutch text-to-speech dataset with 596,508 audio samples totaling 234GB of…
UltraVoice
UltraVoice: Scaling Fine-Grained Style-Controlled Speech Conversations for Spoken Dialogue Models 📝 Abstract Spoken dialogue models currently lack…
Mimba PLT TTS Dataset (Plateau Malagasy Synthetic Speech)
Mimba PLT TTS Dataset (Plateau Malagasy Synthetic Speech)
Risale-i Nur Sesli Külliyat — Risale-i Nur Audio Corpus
Risale-i Nur Sesli Külliyat — Risale-i Nur Audio Corpus
OpenDialog
OpenDialog OpenDialog is a 6.8k hours spoken dialogue dataset, introduced in the paper ZipVoice-Dialog: Non-Autoregressive Spoken Dialogue Generation…
Emilia-NV
NVSpeech Dataset Overview The NVSpeech dataset provides extensive annotations of paralinguistic vocalizations for Mandarin Chinese speech, aimed at…
spoken-magpie-ja
Spoken-magpie LLMの日本語Instruction Tuning用データllm-jp/magpie-sft-v1.0をCosyVoice2 TTSを使用して音声化した商用利用可能な日本語の音声言語モデルのSFT用データセットです。 ある程度の話者多様性を持つように生成されています。…
MintTTS Pre-tokenized Audio (somu9/hindi-hq)
MintTTS Pre-tokenized Audio (somu9/hindi-hq)
Magpie-Speech-Orpheus-125k
Magpie-Speech-Orpheus-125k A ~125k-sample synthetic speech dataset generated by applying the Magpie instruction-synthesis approach to the Orpheus-TTS…
vaja-thai
Vaja-Thai (วาจา) — Combined Thai TTS Dataset A unified, quality-filtered Thai speech dataset combining multiple sources for Text-to-Speech…
InfoRe Technology public dataset №2
InfoRe Technology public dataset №2