Skip to content
Advertisement

Text

2,175 results

AudioMultimodalTabular

multi_lingo_data

Multi-lingual TTS Data (leeoxiang/multi lingo data) Large-scale cross-lingual + same-lingual TTS corpus for training expressive multi-lingual…

1K–10K·CC-BY-NC
AudioMultimodalText

echo-clones-4m-en

echo-clones-4m-en ~4 M English TTS clone utterances generated with EchoTTS (jordand/echo-tts-base). Sample rate: 44 100 Hz, 16-bit PCM…

1M–10M·Apache-2.0·Parquet
AudioMultimodalText

AISHELL-4

AISHELL-4 Identifier: SLR111 Summary: A Free Mandarin Multi-channel Meeting Speech Corpus, provided by Beijing Shell Shell Technology Co.,Ltd…

Apache-2.0
AudioMultimodalText

BigAudioDataset

AstraMindAI/BigAudioDataset Dataset Description AstraMindAI/BigAudioDataset is a large-scale, multilingual dataset designed for a wide range of audio…

1M–10M·Apache-2.0·Arrow
AudioMultimodalText

commonvoice22_sidon

CV22-Sidon Overview This dataset hosts a release of Mozilla Common Voice 22 restored with the Sidon speech restoration…

10M–100M·CC0·WebDataset
AudioMultimodalText

openwhisper

Streaming ASR Dataset This dataset is designed for training real-time (streaming) ASR models, with a focus on handling…

100K–1M·MIT·Parquet
Advertisement