Skip to content
Advertisement

Text

2,175 results

AudioMultimodalText

SynParaSpeech

Description Here is the SynParaSpeech dataset. SynParaSpeech is the first automated synthesis framework for constructing large-scale paralinguistic…

10K–100K·CC-BY-NC-SA·Parquet
AudioMultimodalText

Nav-train-gnjr-s-t-t

Nav-train-gnjr-s-t-t Persian speech dataset. Audio resampled to 16000 Hz. Splits Split Samples Total Duration (H:MM:SS) Volume train 160931…

100K–1M·Parquet
AudioMultimodalText

TV-44kHz-Full

The "Thorsten-Voice" dataset This truly open source (CC0 license) german (🇩🇪) voice dataset contains about 40 hours of…

10K–100K·CC0
AudioMultimodalText

cantonese-youtube-tts

Cantonese Audio TTS Dataset This dataset contains alvanlii/cantonese-radio, alvanlii/cantonese-youtube, plus a dataset of equal size. It is catered…

1M–10M·Parquet
AudioMultimodalText

IndicTTS_Tamil

Tamil Indic TTS Dataset This dataset is derived from the Indic TTS Database project, specifically using the Tamil…

1K–10K·CC-BY·Parquet
AudioMultimodalText

Ace-Taffy-voice

关注永雏塔菲喵,关注永雏塔菲谢谢喵 永雏塔菲语音数据集 数据来自永雏塔菲直播,使用 silero vad + whisper-large-v3-trubo 粗略标注后,人工修正。 微调示例代码:

1K–10K·MIT·Parquet
Advertisement