Text
2,175 results
multi_lingo_data
Multi-lingual TTS Data (leeoxiang/multi lingo data) Large-scale cross-lingual + same-lingual TTS corpus for training expressive multi-lingual…
echo-clones-4m-en
echo-clones-4m-en ~4 M English TTS clone utterances generated with EchoTTS (jordand/echo-tts-base). Sample rate: 44 100 Hz, 16-bit PCM…
Multilingual MFA-Aligned Speech Dataset
Multilingual MFA-Aligned Speech Dataset
irodori-clones-3m-v2-no-emoji
Irodori TTS Clones v2 (3.29M) 3,290,000 cloned utterances generated with Aratako/Irodori-TTS-500M-v2, using the 10,000 reference voices from…
AISHELL-4
AISHELL-4 Identifier: SLR111 Summary: A Free Mandarin Multi-channel Meeting Speech Corpus, provided by Beijing Shell Shell Technology Co.,Ltd…
BEAT2-English + additional annotations (RAG-Gesture / MIBURI)
BEAT2-English + additional annotations (RAG-Gesture / MIBURI)
Reachy Mini Emotions Library
Reachy Mini Emotions Library
tts-pretrain-clones-3m-mos
TTS Pretrain Clones (3M) — with DNSMOS This is SynDataLab/tts-pretrain-clones-3m with an added per-utterance dnsmos column (DNSMOS P.835…
A Multilingual Speech Dataset for SLU and Beyond
A Multilingual Speech Dataset for SLU and Beyond
LIEPA-3 Lithuanian Speech Corpus
LIEPA-3 Lithuanian Speech Corpus
BigAudioDataset
AstraMindAI/BigAudioDataset Dataset Description AstraMindAI/BigAudioDataset is a large-scale, multilingual dataset designed for a wide range of audio…
commonvoice22_sidon
CV22-Sidon Overview This dataset hosts a release of Mozilla Common Voice 22 restored with the Sidon speech restoration…
English-Centric Multilingual Audio Dataset
English-Centric Multilingual Audio Dataset
openwhisper
Streaming ASR Dataset This dataset is designed for training real-time (streaming) ASR models, with a focus on handling…