Skip to content
Advertisement

Multimodal

2,368 results

AudioMultimodalText

C3T

C3T: Cross-modal Capabilities Conservation Test Dataset Description C3T (Cross-modal Capabilities Conservation Test) is a benchmark for assessing the…

100K–1M·CC-BY
AudioMultimodalText

everyayah-phonemes

Phoneme-labelled Quran Datatset This dataset contains recitations from 45 professional Quran reciters, sourced from EveryAyah and QUL. The…

100K–1M·CC-BY·Parquet
AudioMultimodalText

BibleMMS

The Dataset associated with the Paper "Meta Learning Text-to-Speech Synthesis in over 7000 Languages" by Florian Lux, Sarina…

100K–1M·MIT·Parquet
Advertisement