Skip to content
Advertisement

English

1,233 results

AudioMultimodalText

AudioMarathon

AudioMarathon AudioMarathon is a long-context audio benchmark for evaluating multimodal LLMs on speech, music, environmental audio, and meetings.…

<1K·Custom / Research-only·CSV
AudioMultimodalText

meow-10k

Dataset Card for Meow-10K Meow-10K is a high-fidelity, synchronized quad-modal dataset comprising 10,000 feline samples. It is the…

10K–100K·Apache-2.0·JSON
AudioMultimodalText

libritts_r

Dataset Card for LibriTTS-R LibriTTS-R 1 is a sound quality improved version of the LibriTTS corpus ( which…

100K–1M·CC-BY·Parquet
Audio

LibriBrain

LibriBrain (Sherlock Holmes 1–7) Paper Code This repository contains the LibriBrain data organised by book: MEG recordings (.h5),…

CC-BY-NC
AudioMultimodalText

voicebench

License The dataset is available under the Apache 2.0 license. Citation If you use the VoiceBench dataset in…

10K–100K·Apache-2.0·Parquet
AudioMultimodalText

urbansound8K

(card and dataset copied from This dataset contains 8732 labeled sound excerpts (<=4s) of urban sounds from 10…

1K–10K·CC-BY-NC·Parquet
AudioMultimodalText

police-scanner-audio

Police Scanner Audio Dataset A comprehensive collection of police and emergency services radio communications from multiple US cities,…

1K–10K·CC-BY·Audio (folder)
Advertisement