Skip to content
Advertisement

Gated

293 results

MultimodalTabularText

liars-bench

Liars' Bench Liars' Bench is a benchmark for evaluating lie-detectors for language models. For details, see paper here.…

10K–100K·Custom / Research-only·Parquet
MultimodalTabularText

wildguardmix

Dataset Card for WildGuardMix Disclaimer: The data includes examples that might be disturbing, harmful or upsetting. It includes…

10K–100K·ODC-BY·Parquet
MultimodalTabularText

the-stack-smol

Dataset Description A small subset (~0.1%) of the-stack dataset, each programming language has 10,000 random samples from the…

100K–1M·JSON
MultimodalTabularText

kinetics400

Kinetics-400 Video Dataset This dataset is derived from the Kinetics-400 dataset, which is released under the Creative Commons…

10K–100K·Parquet
Video

VAP-Data

Video-As-Prompt: Unified Semantic Control for Video Generation 🔥 News Oct 24, 2025: 📖 We release the first unified…

10K–100K·Apache-2.0
Video

RoboMemArena

RoboMemArena 数据集文件元信息以及数据文件,请浏览“数据集文件”页面获取。 当前数据集卡片使用的是默认模版,数据集的贡献者未提供更加详细的数据集介绍,但是您可以通过如下GIT Clone命令,或者ModelScope SDK来下载数据集 下载方法 Task Categories…

<1K·Apache-2.0
ImageMultimodalVideo

GOKU-2M

Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing GOKU-2M is a large-scale, unified instruction-based…

1M–10M·CC-BY-NC
MultimodalTextVideo

finevideo

FineVideo FineVideo Description Dataset Explorer Revisions Dataset Distribution How to download and use FineVideo Using datasets Using huggingface…

10K–100K·Other·Parquet
Video

MVLU

MLVU: Multi-task Long Video Understanding Benchmark This repo contains the annotation data and evaluation code for the paper…

CC-BY-NC-SA
Advertisement