English
1,233 results
VideoKR-Train
VideoKR-Train 📄 ArXiv | 💻 Code | 🤗 Collection About This repository contains the VideoKR training data presented…
WorldMemArena
WorldMemArena WorldMemArena is a large-scale multimodal memory benchmark designed to evaluate how well AI systems retain, update, and…
MMFineReason-Full-2.3M-Qwen3-VL-235B-Thinking
MMFineReason-Full-2.3M The Complete Pre-Selection Dataset — Before Quality Filtering 📖 Overview MMFineReason-Full-2.3M is the complete pre-selection…
REVERSE
REVERSE Dataset Dataset for REVERSE (Reinforcing Evidence Verification and Search for Agentic Image Geolocation). This dataset supports training…
GUIDE-dataset
GUIDE: Resolving Domain Bias in GUI Agents through Real-Time Web Video Retrieval and Plug-and-Play Annotation GUI Unbiasing via…
Cambrian Vision-Centric Benchmark (CV-Bench)
Cambrian Vision-Centric Benchmark (CV-Bench)
Kvasir-VQA-x1
Kvasir-VQA-x1 A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy Kvasir-VQA-x1 on GitHub Original Image…
Banana-Merged: Multi-page VQA with Hard Negatives
Banana-Merged: Multi-page VQA with Hard Negatives
ChartGalaxy
ChartGalaxy: A Dataset for Infographic Chart Understanding and Generation 🤗 Dataset 🖥️ Code 📄 Paper 🔥 News 2026.02…
RoboBench
RoboBench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain 📋 Overview RoboBench is a…
MMMU_Pro
MMMU-Pro (A More Robust Multi-discipline Multimodal Understanding Benchmark) 🌐 Homepage 🏆 Leaderboard 🤗 Dataset 🤗 Paper 📖 arXiv…
Eka Medical Asr Sample Noise Eval Dataset
Eka Medical Asr Sample Noise Eval Dataset