Hinglish Concatenated Audio Dataset
Hinglish Concatenated Audio Dataset
595 results
Hinglish Concatenated Audio Dataset
OpenSTT annotate by Balalaika
agent-sft-stitch-zh-tts Voiced version of voidful/agent-sft-stitch-zh: the STITCH-S spoken chunks synthesized with BlueMagpie-TTS (hung yi lee…
Emolia-Thinking (VoiceNet balanced subset)
LinTO DataSet Audio for Arabic Tunisian Augmented A collection of Tunisian dialect audio and its annotations for STT…
Dataset Audio Russian This is a dataset with Russian audio data, split into train for tasks like text-to-speech,…
SibmaBench Data Release & Benchmarking To evaluate your model on SimbaBench across all supported tasks (ASR, TTS, and…
Uzbek YouTube Speech Dataset
NaturalVoices Restored (48 kHz, Sidon + UTMOS-filtered)
Arabic Diacritized-Stem Lexicon
Open Bible Resources — African Languages
C3T: Cross-modal Capabilities Conservation Test Dataset Description C3T (Cross-modal Capabilities Conservation Test) is a benchmark for assessing the…
QuranLab — Qur'an Recitation Audio: Reference Manifest & CC-BY Word Timing
Urdu-ONYX-WAV-real-Annotated Enhanced version of Urdu-ONYX-WAV-real with phoneme annotations and Kanade tokenizer features. Dataset Statistics Total…
MOSS Character Voices — Best-of-64 (Stage 2) Best-of-64 voice-acting takes from the 4.55B MOSS-TTS-Local voice-acting model…
Phoneme-labelled Quran Datatset This dataset contains recitations from 45 professional Quran reciters, sourced from EveryAyah and QUL. The…