Skip to content
Advertisement

CC-BY

672 results

AudioMultimodalText

libritts

Dataset Card for LibriTTS LibriTTS is a multi-speaker English corpus of approximately 585 hours of read English speech…

100K–1M·CC-BY·Parquet
AudioMultimodalText

FalAR

FalAR FalAR is a large-scale, speaker-annotated European Portuguese speech corpus built from recordings of parliamentary sessions of the…

100K–1M·CC-BY·Parquet
AudioMultimodalText

libritts_r

Dataset Card for LibriTTS-R LibriTTS-R 1 is a sound quality improved version of the LibriTTS corpus ( which…

100K–1M·CC-BY·Parquet
AudioMultimodalText

MRSAudio

MRSAudio: A Large-Scale Multimodal Recorded Spatial Audio Dataset with Refined Annotations Humans rely on multisensory integration to perceive…

100K–1M·CC-BY·CSV
AudioMultimodalText

mls_sidon

MLS-Sidon Overview This dataset is a cleansed version of Multilingual LibriSpeech (MLS) with Sidon speech restoration mode for…

10M–100M·CC-BY·WebDataset
AudioMultimodalText

floras

FLORAS FLORAS is a 50-language benchmark For LOng-form Recognition And Summarization of spoken language. The goal of FLORAS…

10K–100K·CC-BY·Parquet
AudioMultimodalText

police-scanner-audio

Police Scanner Audio Dataset A comprehensive collection of police and emergency services radio communications from multiple US cities,…

1K–10K·CC-BY·Audio (folder)
Advertisement