ImageMultimodalText
DocVQA-2026
DocVQA 2026 ICDAR2026 Competition on Multimodal Reasoning over Documents in Multiple Domains Building upon previous DocVQA benchmarks, this…
<1K·Parquet
5 results
DocVQA 2026 ICDAR2026 Competition on Multimodal Reasoning over Documents in Multiple Domains Building upon previous DocVQA benchmarks, this…
CharXiv: Charting Gaps in Realistic Chart Understanding in Multimodal LLMs NeurIPS 2024 🏠Home (🚧Still in construction) 🤗Data 🥇Leaderboard…
Banana-Merged: Multi-page VQA with Hard Negatives
Russian Receipts OCR (Semantic) Overview This repository contains a dataset of Russian retail receipts with semantic OCR annotations.…
Document Haystack Dataset This repository contains the dataset for the paper “Document Haystack: A Long Context Multimodal Image/Document…