Datasets
464 results
captioned-ai-music-snippets
Dataset Overview A collection of short audio snippets (3–30 seconds) extracted from publicly shared Suno‑generated songs and captioned…
multi_lingo_data
Multi-lingual TTS Data (leeoxiang/multi lingo data) Large-scale cross-lingual + same-lingual TTS corpus for training expressive multi-lingual…
echo-clones-4m-en
echo-clones-4m-en ~4 M English TTS clone utterances generated with EchoTTS (jordand/echo-tts-base). Sample rate: 44 100 Hz, 16-bit PCM…
Multilingual MFA-Aligned Speech Dataset
Multilingual MFA-Aligned Speech Dataset
irodori-clones-3m-v2-no-emoji
Irodori TTS Clones v2 (3.29M) 3,290,000 cloned utterances generated with Aratako/Irodori-TTS-500M-v2, using the 10,000 reference voices from…
AISHELL-4
AISHELL-4 Identifier: SLR111 Summary: A Free Mandarin Multi-channel Meeting Speech Corpus, provided by Beijing Shell Shell Technology Co.,Ltd…
central-kurdish-audiobook-raw
Central Kurdish Audiobook Raw Audio Collection Overview This repository contains a large collection of raw Central Kurdish (Sorani…
PersonalHub
Personal Hub: Exploring High-Expressiveness Speech Data through Spatio-Temporal Feature Integration and Model Fine-Tuning Introduction In this work,…
advanced-soundscapes-stage-1
Advanced Soundscapes Stage 1 — Raw Components (5M) This dataset contains Stage 1 output from the LAION Universal…
BEAT2-English + additional annotations (RAG-Gesture / MIBURI)
BEAT2-English + additional annotations (RAG-Gesture / MIBURI)
MIT_environmental_impulse_responses
MIT Environmental Impulse Response Dataset The audio recordings in this dataset are originally created by the Computational Audition…
french-tts-conversational-dataset
French Conversational TTS Dataset Dataset Description This dataset contains high-fidelity French text-to-speech audio clips generated using Mistral's…
Reachy Mini Emotions Library
Reachy Mini Emotions Library