Multimodal
2,368 results
panlex-meanings
Dataset Card for panlex-meanings This is a dataset of words in several thousand languages, extracted from Dataset Details…
Mixed Arabic Datasets (MAD) Corpus
Mixed Arabic Datasets (MAD) Corpus
OpenSakura Eve LN Aligned Dataset
OpenSakura Eve LN Aligned Dataset
Translated German-English ASR Dataset
Translated German-English ASR Dataset
Multilingual TEDx (mTEDx) — SLR100
Multilingual TEDx (mTEDx) — SLR100
BEAF
BEAF: Before-After Changes for Hallucination Evaluation BEAF is a benchmark for evaluating object hallucination in vision-language models using…
MultiChartQA
MultiChartQA This repository contains the questions and answers for our Multi-chart Benchmark. At present, only the data is…
DocVQA-2026
DocVQA 2026 ICDAR2026 Competition on Multimodal Reasoning over Documents in Multiple Domains Building upon previous DocVQA benchmarks, this…
GQA-ru
GQA-ru This is a translated version of original GQA dataset and stored in format supported for lmms-eval pipeline.…
V1-33K-Old
V1: Toward Multimodal Reasoning by Designing Auxiliary Tasks 🚀 Toward Multimodal Reasoning via Unsupervised Task -- Future Prediction…
vision-arena-bench-v0.1
VisionArena-Bench: An automatic eval pipeline to estimate model preference rankings An automatic benchmark of 500 diverse user prompts…