Skip to content
Advertisement

Audio

514 results

Hive AI

Labeling & Annotation

San Francisco AI company operating Hive Data, a managed data-collection and annotation service with a distributed contributor network.

AudioImageTextVideo
AudioImageMultimodal

SoundingEarth

SoundingEarth SoundingEarth is a geo-referenced soundscape dataset that pairs Google Earth imagery with geotagged environmental audio recordings…

10K–100K·CC-BY·Parquet
Audio

dialogue-episodes

Multi-Language Dialogue Episodes Dataset Dataset Description This dataset contains dialogue episodes with multi-language transcripts and separated…

1K–10K·CC-BY-NC·Audio (folder)
Audio

StreamUni

The training dataset for the paper 'StreamUni: Achieving Streaming Speech Translation with a Unified Large Speech-Language Model' Model…

1K–10K·Apache-2.0·Audio (folder)
AudioMultimodalText

ScreenTalk_JA2ZH-XS

ScreenTalk JA2ZH-XS ScreenTalk JA2ZH-XS is a paired dataset of Japanese speech and Chinese translated text released by DataLabX.…

10K–100K·Parquet
AudioMultimodalText

MultiMed-ST

MultiMed-ST: Large-scale Many-to-many Multilingual Medical Speech Translation 📘 EMNLP 2025 Khai Le-Duc , Tuyen Tran , Bach Phan…

10K–100K·MIT·Parquet
AudioMultimodalText

wmt-human-all-TTS

WMT Human + TTS Audio WMT human evaluation data (zouharvi/wmt-human-all) extended with TTS-synthesised source audio, covering 49 language…

100K–1M·CC-BY·Parquet
AudioImageMultimodal

Unify-OmniBench

Unify-OmniBench 统一格式的多模态评测数据集,由 Unify-OmniBench 框架转换生成。 包含四个 benchmark,在 Dataset Viewer 右上角下拉框切换。 数据概览 Config (bench) 题目数 模态 媒体 daily omni ~1197…

1K–10K·Custom / Research-only·Parquet
Advertisement