Datasets
3,216 results
Jalak Indonesian Multi-Speaker TTS
Jalak Indonesian Multi-Speaker TTS
voicebench
License The dataset is available under the Apache 2.0 license. Citation If you use the VoiceBench dataset in…
UrbanSound8K
UrbanSound8K This is an audio classification dataset for Sound Event Classification. Classes = 10 , Split = Ten-Fold…
mls_sidon
MLS-Sidon Overview This dataset is a cleansed version of Multilingual LibriSpeech (MLS) with Sidon speech restoration mode for…
Bo du lieu giong noi tieng Viet
Bo du lieu giong noi tieng Viet
Daily-Omni (QA repackaged for lmms-eval)
Daily-Omni (QA repackaged for lmms-eval)
floras
FLORAS FLORAS is a 50-language benchmark For LOng-form Recognition And Summarization of spoken language. The goal of FLORAS…
urbansound8K
(card and dataset copied from This dataset contains 8732 labeled sound excerpts (<=4s) of urban sounds from 10…
cineaudiosynth
CineAudioSynth Synthetic cinematic audio for source separation. 453 scenes, ~22.8 h, 48 kHz / 16-bit / stereo WAV.…
mu-bench
Dataset Card for μ-Bench (Leaderboard Code) μ-Bench is a multilingual transcription benchmark built from real customer-service phone conversations.…
NISR — Neural Inverse Sound Rendering Dataset
NISR — Neural Inverse Sound Rendering Dataset
Multilingual MFA-Aligned Speech Dataset
Multilingual MFA-Aligned Speech Dataset
JamendoMaxCaps
JamendoMaxCaps Dataset JamendoMaxCaps is a large-scale dataset of over 362,000 instrumental tracks sourced from the Jamendo platform. It…
police-scanner-audio
Police Scanner Audio Dataset A comprehensive collection of police and emergency services radio communications from multiple US cities,…
captioned-ai-music-snippets
Dataset Overview A collection of short audio snippets (3–30 seconds) extracted from publicly shared Suno‑generated songs and captioned…