Multilingual MFA-Aligned Speech Dataset
Multilingual MFA-Aligned Speech Dataset
2,368 results
Multilingual MFA-Aligned Speech Dataset
Irodori TTS Clones v2 (3.29M) 3,290,000 cloned utterances generated with Aratako/Irodori-TTS-500M-v2, using the 10,000 reference voices from…
AISHELL-4 Identifier: SLR111 Summary: A Free Mandarin Multi-channel Meeting Speech Corpus, provided by Beijing Shell Shell Technology Co.,Ltd…
BEAT2-English + additional annotations (RAG-Gesture / MIBURI)
Reachy Mini Emotions Library
TTS Pretrain Clones (3M) — with DNSMOS This is SynDataLab/tts-pretrain-clones-3m with an added per-utterance dnsmos column (DNSMOS P.835…
A Multilingual Speech Dataset for SLU and Beyond
LIEPA-3 Lithuanian Speech Corpus
AstraMindAI/BigAudioDataset Dataset Description AstraMindAI/BigAudioDataset is a large-scale, multilingual dataset designed for a wide range of audio…
CV22-Sidon Overview This dataset hosts a release of Mozilla Common Voice 22 restored with the Sidon speech restoration…
English-Centric Multilingual Audio Dataset
Streaming ASR Dataset This dataset is designed for training real-time (streaming) ASR models, with a focus on handling…