Skip to content
Advertisement

CC-BY

672 results

AudioMultimodalText

C3T

C3T: Cross-modal Capabilities Conservation Test Dataset Description C3T (Cross-modal Capabilities Conservation Test) is a benchmark for assessing the…

100K–1M·CC-BY
AudioMultimodalText

everyayah-phonemes

Phoneme-labelled Quran Datatset This dataset contains recitations from 45 professional Quran reciters, sourced from EveryAyah and QUL. The…

100K–1M·CC-BY·Parquet
Audio

emolia-thinking-balanced-buckets

Emolia-Thinking — Balanced Per-Dimension Bucket Subset A balanced, per-dimension bucket subset of VoiceNet/emolia-thinking, derived from that…

100K–1M·CC-BY
AudioMultimodalText

parczech4speech-segmented

ParCzech4Speech (Sentence-Segmented Variant) Dataset Summary ParCzech4Speech (Sentence-Segmented Variant) is a large-scale Czech speech dataset based…

100K–1M·CC-BY·WebDataset
AudioMultimodalText

Pretraining-V1

Indic TTS Unified v1 A large-scale, unified collection of speech data for text-to-speech (TTS) and speech research. This…

10M–100M·CC-BY·Parquet
Text

LEMAS-Dataset-train

Overview This dataset is part of LEMAS-Project (lemas-project.github.io/LEMAS-Project). It contains a large-scale training set (150k+ hours) and a…

100M–1B·CC-BY·JSON
ImageMultimodalTabular

nutriderm-dataset

NutriDermAI Dataset Dataset for NutriDermAI — Multimodal AI System for Dermatology with ABCDE Explainability and VQA. M.Tech Thesis…

1M–10M·CC-BY·Parquet
Advertisement