Skip to content
Advertisement

Audio (folder)

54 results

AudioMultimodalText

MMAE

MMAE: A Massive Multitask Audio Editing Benchmark 📖 arXiv 🎬 MMAE Demo Video 🛠️ GitHub Code 🔊 HuggingFace…

1K–10K·Audio (folder)
AudioMultimodalVideo

rh20t_cfg1

rh20t cfg1 — RH20T → LeRobot v3 (flexiv) Unofficial LeRobot Dataset v3 reformatting of an RH20T config. RGB…

1K–10K·Custom / Research-only·Audio (folder)
AudioMultimodalText

cineaudiosynth

CineAudioSynth Synthetic cinematic audio for source separation. 453 scenes, ~22.8 h, 48 kHz / 16-bit / stereo WAV.…

1K–10K·CC-BY-NC-SA·Audio (folder)
AudioMultimodalText

mu-bench

Dataset Card for μ-Bench (Leaderboard Code) μ-Bench is a multilingual transcription benchmark built from real customer-service phone conversations.…

1K–10K·CC-BY-NC·Audio (folder)
AudioMultimodalText

police-scanner-audio

Police Scanner Audio Dataset A comprehensive collection of police and emergency services radio communications from multiple US cities,…

1K–10K·CC-BY·Audio (folder)
Audio

french-tts-conversational-dataset

French Conversational TTS Dataset Dataset Description This dataset contains high-fidelity French text-to-speech audio clips generated using Mistral's…

<1K·Apache-2.0·Audio (folder)
Audio

MIT_environmental_impulse_responses

MIT Environmental Impulse Response Dataset The audio recordings in this dataset are originally created by the Computational Audition…

<1K·Custom / Research-only·Audio (folder)
Audio

central-kurdish-audiobook-raw

Central Kurdish Audiobook Raw Audio Collection Overview This repository contains a large collection of raw Central Kurdish (Sorani…

10K–100K·Audio (folder)
Audio

WearVox

WearVox: An Egocentric Multichannel Voice Assistant Benchmark for Wearables Paper: WearVox: An Egocentric Multichannel Voice Assistant Benchmark for…

1K–10K·CC-BY-NC·Audio (folder)
Advertisement