Image
1,418 results
OpenDocVQA-Corpus
Dataset Card for OpenDocVQA This is a training and evaluation corpus data file for VDocRAG, a new RAG…
MMFineReason-1.8M-Qwen3-VL-235B-Thinking
MMFineReason Closing the Multimodal Reasoning Gap via Open Data-Centric Methods Average score across mathematical reasoning and multimodal…
finevision-sample
FineVision Sample Dataset A comprehensive multimodal dataset containing samples across multiple categories, designed for visual question answering…
Unify-OmniBench
Unify-OmniBench 统一格式的多模态评测数据集,由 Unify-OmniBench 框架转换生成。 包含四个 benchmark,在 Dataset Viewer 右上角下拉框切换。 数据概览 Config (bench) 题目数 模态 媒体 daily omni ~1197…
MathVerse
Dataset Card for MathVerse Dataset Description Paper Information Dataset Examples Leaderboard Citation Dataset Description The capabilities of…
HoloCount
HoloCount: A Holistic Visual Counting Benchmark for MLLMs Abstract Visual counting is a fundamental pillar of multimodal intelligence,…
StepCountQA-SFT
StepCountQA-SFT StepCountQA-SFT is a multimodal supervised fine-tuning (SFT) dataset for visual object counting with step-by-step reasoning. Built…
MathVerse-lmmseval
Dataset Card for MathVerse This is the version for lmms-eval. This shares the same data with the official…
ImgCode-8.6M
MathCoder-VL: Bridging Vision and Code for Enhanced Multimodal Mathematical Reasoning Repo: Paper: Introduction We introduce MathCoder-VL, a series…
causalphys
Causal-VL Dataset Causal reasoning VQA dataset with 4 categories × 4 subcategories (3062 questions). Structure Each subcategory contains:…
DenseFusion-1M for comprehensive image descriptions
DenseFusion-1M for comprehensive image descriptions
Viva Mais Synthetic PT-BR Travel Document Vision Dataset
Viva Mais Synthetic PT-BR Travel Document Vision Dataset
MathCanvas-Bench
MathCanvas-Bench 🚀 Data Usage from datasets import load dataset dataset = load dataset("shiwk24/MathCanvas-Bench") print(dataset) 📖 Introduction…