Parquet
1,501 results
CSEMOTIONS
CSEMOTIONS: High-Quality Mandarin Emotional Speech Dataset Paper Code CSEMOTIONS is a high-quality Mandarin emotional speech dataset designed for…
turkish-tts-combined-raw
Türkçe TTS Birleşik Veri Seti 7 farklı açık kaynak Türkçe TTS veri setinin birleşimi. ~81,500 örnek 24kHz SNAC…
FalAR-TTS
FalAR-TTS FalAR-TTS is a subset of the FalAR dataset ( tailored for speech synthesis in European Portuguese. To…
InfoRe Technology public dataset №2
InfoRe Technology public dataset №2
Mohamed Khairy Arabic Speech Dataset
Mohamed Khairy Arabic Speech Dataset
Hinglish Concatenated Audio Dataset
Hinglish Concatenated Audio Dataset
VoxCPM Ghana — Precomputed AudioVAE Latents
VoxCPM Ghana — Precomputed AudioVAE Latents
OpenSTT annotate by Balalaika
OpenSTT annotate by Balalaika
VLSP 2020 – VinAI – ASR challenge dataset
VLSP 2020 - VinAI - ASR challenge dataset
ne-tts-ccp
NE-TTS Chakma (ccp) Cleaned TTS dataset for Chakma (ccp), a North East Indian language. Derived from the Vaani…
linto-dataset-audio-ar-tn
LinTO DataSet Audio for Arabic Tunisian A collection of Tunisian dialect audio and its annotations for STT task…
agent-sft-stitch-zh-tts
agent-sft-stitch-zh-tts Voiced version of voidful/agent-sft-stitch-zh: the STITCH-S spoken chunks synthesized with BlueMagpie-TTS (hung yi lee…
Kasem Speech-Text Parallel Dataset
Kasem Speech-Text Parallel Dataset
irodori-tts-refs-12k
Irodori TTS Reference Voices (12,160) 12,160 Japanese reference voices generated with Aratako/Irodori-TTS-500M-v2-VoiceDesign. field type description…