Custom / Research-only
363 results
AVQA (Audio-Visual QA) — Videos + Annotations
AVQA (Audio-Visual QA) — Videos + Annotations
Unify-OmniBench
Unify-OmniBench 统一格式的多模态评测数据集,由 Unify-OmniBench 框架转换生成。 包含四个 benchmark,在 Dataset Viewer 右上角下拉框切换。 数据概览 Config (bench) 题目数 模态 媒体 daily omni ~1197…
lapchole-focus-vqa
LapChole-FOCUS-VQA A clinically grounded benchmark for long-context video understanding in minimally invasive surgery. 💻 Code • 🏆…
ivrit.ai – Knesset Plenums Whisper Training
ivrit.ai - Knesset Plenums Whisper Training
Kahwa Postcast Arabic Speech Dataset
Kahwa Postcast Arabic Speech Dataset
Syrian Postcast Arabic Speech Dataset
Syrian Postcast Arabic Speech Dataset
live-atc-europe
Live ATC Europe — audio + transcriptions Enregistrements live d'air traffic control (ATC) européen, capturés depuis LiveATC.net, segmentés…
Mostafa Mahmoud Arabic Speech Dataset
Mostafa Mahmoud Arabic Speech Dataset
Deep Confessions Podcast Arabic Speech Dataset
Deep Confessions Podcast Arabic Speech Dataset
Risale-i Nur Sesli Külliyat — Risale-i Nur Audio Corpus
Risale-i Nur Sesli Külliyat — Risale-i Nur Audio Corpus
Loubna Stories Arabic Speech Dataset
Loubna Stories Arabic Speech Dataset
vaja-thai
Vaja-Thai (วาจา) — Combined Thai TTS Dataset A unified, quality-filtered Thai speech dataset combining multiple sources for Text-to-Speech…
Mohamed Khairy Arabic Speech Dataset
Mohamed Khairy Arabic Speech Dataset