Skip to content
Advertisement

Text-to-Speech

312 results

MultimodalTabularText

Talker-T2AV-Data

Talker-T2AV-Data Joint Talking Audio-Video Generation with Autoregressive Diffusion Modeling Paper (arXiv 2604.23586) · Code (GitHub) · Model ·…

100K–1M·Apache-2.0·CSV
Audio

open-swara

Open Swara The largest open-source humanized voice library -- 4,065 voice samples across 44 languages, free forever under…

1K–10K·CC-BY-SA
AudioMultimodalText

libritts

Dataset Card for LibriTTS LibriTTS is a multi-speaker English corpus of approximately 585 hours of read English speech…

100K–1M·CC-BY·Parquet
AudioMultimodalText

libritts_r

Dataset Card for LibriTTS-R LibriTTS-R 1 is a sound quality improved version of the LibriTTS corpus ( which…

100K–1M·CC-BY·Parquet
AudioMultimodalText

AISHELL-3

AISHELL-3 is a large-scale and high-fidelity multi-speaker Mandarin speech corpus published by Beijing Shell Shell Technology Co.,Ltd. It…

10K–100K·Apache-2.0
Advertisement