Skip to content
Advertisement

<1K

439 results

AudioMultimodalVideo

MRSDrama

ISDrama: Immersive Spatial Drama Generation through Multimodal Prompting Yu Zhang , Wenxiang Guo , Changhao Pan , Zhiyuan…

<1K·CC-BY-NC-SA
Audio

hawrami-kurdish-raw-audio

Hawrami Raw Audio Collection Overview This repository contains approximately 500 hours of Hawrami Kurdish raw speech collected from…

<1K·Audio (folder)
Audio

southern-kurdish-raw-audio

Southern Kurdish Raw Audio Collection Overview This repository contains approximately 170 hours of Southern Kurdish (SDH) raw speech…

<1K·Audio (folder)
AudioMultimodalText

sayoko-tts-corpus

サヨ子 音声コーパス ダウンロード方法 データセットを圧縮したzipファイルを、gdriveに置いています。 import gdown url = " RcBAaAyRwEIOWuTQFetVaMUU" gdown.download( url,…

<1K·CC-BY·Text (raw)
Audio

french-tts-conversational-dataset

French Conversational TTS Dataset Dataset Description This dataset contains high-fidelity French text-to-speech audio clips generated using Mistral's…

<1K·Apache-2.0·Audio (folder)
Image

LCSD

LCSD

<1K·Apache-2.0·Images (folder)
Text

msd-hepatic-vessel

Medical Segmentation Decathlon: Hepatic Vessel Dataset Description This is the Hepatic Vessel dataset from the Medical Segmentation Decathlon…

<1K·CC-BY-SA·JSON
Video

DAVIS-2017-480p-mp4

DAVIS 2017 — 480p MP4 Sequences Pre-encoded MP4 versions of all 90 sequences from the DAVIS 2017 trainval…

<1K·CC-BY-NC
Advertisement