Skip to content
Advertisement

Multimodal

2,368 results

AudioMultimodalText

VieNeu-TTS-140h

pnnbao-ump/VieNeu-TTS-140h Mô tả Dataset A high-quality Vietnamese Text-to-Speech (TTS) dataset containing 74,858 audio samples with phonemized…

10K–100K·Apache-2.0·Arrow
AudioMultimodalText

libritts_r

Dataset Card for LibriTTS-R LibriTTS-R 1 is a sound quality improved version of the LibriTTS corpus ( which…

100K–1M·CC-BY·Parquet
AudioMultimodalText

Quran-Recitations

Quran-Recitations Dataset Overview The Quran-Recitations dataset is a rich and reverent collection of Quranic verses, meticulously paired with…

100K–1M·Parquet
AudioMultimodalText

SynParaSpeech

Description Here is the SynParaSpeech dataset. SynParaSpeech is the first automated synthesis framework for constructing large-scale paralinguistic…

10K–100K·CC-BY-NC-SA·Parquet
AudioMultimodalText

Nav-train-gnjr-s-t-t

Nav-train-gnjr-s-t-t Persian speech dataset. Audio resampled to 16000 Hz. Splits Split Samples Total Duration (H:MM:SS) Volume train 160931…

100K–1M·Parquet
AudioMultimodalText

TV-44kHz-Full

The "Thorsten-Voice" dataset This truly open source (CC0 license) german (🇩🇪) voice dataset contains about 40 hours of…

10K–100K·CC0
AudioMultimodalText

cantonese-youtube-tts

Cantonese Audio TTS Dataset This dataset contains alvanlii/cantonese-radio, alvanlii/cantonese-youtube, plus a dataset of equal size. It is catered…

1M–10M·Parquet
Advertisement