Automatic Speech Recognition
267 results
UltraVoice
UltraVoice: Scaling Fine-Grained Style-Controlled Speech Conversations for Spoken Dialogue Models 📝 Abstract Spoken dialogue models currently lack…
MiscSpeech-ja
MiscSpeech-ja This dataset comprises audio and corresponding transcripts collected from a diverse range of YouTube videos and Podcasts.
Risale-i Nur Sesli Külliyat — Risale-i Nur Audio Corpus
Risale-i Nur Sesli Külliyat — Risale-i Nur Audio Corpus
Loubna Stories Arabic Speech Dataset
Loubna Stories Arabic Speech Dataset
vctk
VCTK This is a processed clone of the VCTK dataset with leading and trailing silence removed using Silero…
Eka Medical ASR Evaluation Dataset
Eka Medical ASR Evaluation Dataset
Emilia-NV
NVSpeech Dataset Overview The NVSpeech dataset provides extensive annotations of paralinguistic vocalizations for Mandarin Chinese speech, aimed at…
hawrami-kurdish-raw-audio
Hawrami Raw Audio Collection Overview This repository contains approximately 500 hours of Hawrami Kurdish raw speech collected from…
Yoruba Speech-Text Parallel Dataset
Yoruba Speech-Text Parallel Dataset
UniST
UniST This dataset contains UniST codec-token training data exported from local metadata and codec results. We train UniSS…
Magpie-Speech-Orpheus-125k
Magpie-Speech-Orpheus-125k A ~125k-sample synthetic speech dataset generated by applying the Magpie instruction-synthesis approach to the Orpheus-TTS…
southern-kurdish-raw-audio
Southern Kurdish Raw Audio Collection Overview This repository contains approximately 170 hours of Southern Kurdish (SDH) raw speech…