Skip to content
Advertisement

Automatic Speech Recognition

267 results

Audio

advanced-soundscapes-stage-1

Advanced Soundscapes Stage 1 — Raw Components (5M) This dataset contains Stage 1 output from the LAION Universal…

1M–10M·CC-BY
Audio

MIT_environmental_impulse_responses

MIT Environmental Impulse Response Dataset The audio recordings in this dataset are originally created by the Computational Audition…

<1K·Custom / Research-only·Audio (folder)
Audio

DailyTalkContiguous-MoodyGirl

Moody Girl: Emotion-Tagged DailyTalk Dataset This dataset is an emotion-tagged version of the DailyTalk dataset, enhanced with emotion…

CC-BY-SA
AudioMultimodalText

openwhisper

Streaming ASR Dataset This dataset is designed for training real-time (streaming) ASR models, with a focus on handling…

100K–1M·MIT·Parquet
AudioMultimodalText

synthetic-asr-hi

Synthetic ASR data — hi Generated by Valsea-ASR/synthetic-data-pipeline. Audio is synthetic (TTS), targeted as training data for downstream…

10K–100K·JSON
Audio

finetuned-hindi-punjabi-denoised

Multilingual Speaker Diarization Dataset This dataset contains synthetic multilingual speaker diarization data with Hindi, English, and Punjabi audio…

1K–10K·MIT
AudioMultimodalText

synthetic-asr-zh

Synthetic ASR data — zh Generated by Valsea-ASR/synthetic-data-pipeline. Audio is synthetic (TTS), targeted as training data for downstream…

10K–100K·JSON
Advertisement