Audio
514 results
esc50
The dataset is available under the terms of the Creative Commons Attribution Non-Commercial license. K. J. Piczak. ESC:…
russia_voices
Russian voices for train AI. ♀ Male and ♂ Female Male voices - 497 pcs. Female voices -…
EuroSpeech-24kHz
EuroSpeech 24 kHz Dataset Dataset Description EuroSpeech is a large-scale multilingual speech corpus containing high-quality aligned parliamentary…
Multilingual MFA-Aligned Speech Dataset
Multilingual MFA-Aligned Speech Dataset
music-mood-recs assets (MTG-Jamendo mood/theme subset mirror)
music-mood-recs assets (MTG-Jamendo mood/theme subset mirror)
reazon-speech-v2-denoised-same-speaker-pair
Reazon Speech v2 DENOISED Same Speaker Pair prj-beatrice/reazon-speech-v2-denoised-titanet-embeddings のコサイン類似度の総和がなるべく大きくなるように…
AppTek Call-Center Dialogues
AppTek Call-Center Dialogues
Tarteel AI – EveryAyah Dataset
Tarteel AI - EveryAyah Dataset
Quranic Recitation Dataset (Word-by-Word)
Quranic Recitation Dataset (Word-by-Word)
AudioMarathon
AudioMarathon AudioMarathon is a long-context audio benchmark for evaluating multimodal LLMs on speech, music, environmental audio, and meetings.…
Afrivoice Swahili Agriculture Subset
Afrivoice Swahili Agriculture Subset
audioset-16khz-wds
AudioSet AudioSet 1 is a large-scale dataset comprising approximately 2 million 10-second YouTube audio clips, categorised into 527…
ASMR-Archive-Processed-SFW
ASMR-Archive-Processed-SFW