Skip to content
Advertisement

Datasets

464 results

AudioMultimodalText

C3T

C3T: Cross-modal Capabilities Conservation Test Dataset Description C3T (Cross-modal Capabilities Conservation Test) is a benchmark for assessing the…

100K–1M·CC-BY
AudioMultimodalText

everyayah-phonemes

Phoneme-labelled Quran Datatset This dataset contains recitations from 45 professional Quran reciters, sourced from EveryAyah and QUL. The…

100K–1M·CC-BY·Parquet
Audio

emolia-thinking-balanced-buckets

Emolia-Thinking — Balanced Per-Dimension Bucket Subset A balanced, per-dimension bucket subset of VoiceNet/emolia-thinking, derived from that…

100K–1M·CC-BY
AudioMultimodalText

BibleMMS

The Dataset associated with the Paper "Meta Learning Text-to-Speech Synthesis in over 7000 Languages" by Florian Lux, Sarina…

100K–1M·MIT·Parquet
Advertisement