Datasets
1,940 results
fake_news
TODO: Add YAML tags here. Copy-paste the tags obtained with the online tagging app: annotations creators: - no-annotation…
filtered-wit
Filtered WIT, an Image-Text Dataset. A reliable Dataset to run Image-Text models. You can find WIT, Wikipedia Image…
ML-ArXiv-Papers
This dataset contains the subset of ArXiv papers with the "cs.LG" tag to indicate the paper is about…
indoor-safety-hazard-detection-and-work-zone-monitoring
Indoor Safety Hazard Detection & Work-Zone Monitoring Generated by datapack-import.ts This dataset mirrors public data-pack render outputs from…
dataset-the-stack-v2-dedup-sub
The Stack v2 Subset with File Contents (Python, Java, JavaScript, C, C++) TempestTeam/dataset-the-stack-v2-dedup-sub Dataset Summary This dataset is…
PersonaMem v2, Implicit Persona, LLM Personalization
PersonaMem v2, Implicit Persona, LLM Personalization
wildguardmix
Dataset Card for WildGuardMix Disclaimer: The data includes examples that might be disturbing, harmful or upsetting. It includes…
coding agent traces – security audits
coding agent traces - security audits
institutional-books-1.0
📚 Institutional Books 1.0 Institutional Books is a growing corpus of public domain books. This 1.0 release is…
BalkanBench SuperGLUE – Serbian
BalkanBench SuperGLUE - Serbian
Ropedia Xperience-10M Task Suite Artifacts
Ropedia Xperience-10M Task Suite Artifacts
lighting-invariant-bedroom-perception-robustness-benchmark
Lighting-Invariant Bedroom Perception & Robustness Benchmark Generated by datapack-import.ts This dataset mirrors public data-pack render outputs…
SurvHTE-Bench
SurvHTE-Bench: A Benchmark for Heterogeneous Treatment Effect Estimation in Survival Analysis Paper: ICLR 2026 — SurvHTE-Bench: A Benchmark…
ScaleEdit-12M
ScaleEdit-12M: Scaling Open-Source Image Editing Data Generation via Multi-Agent Framework 📌 Overview The largest open-source…
AlgoTune
Website Paper Code How good are language models at coming up with new algorithms? To try to answer…
toxic-chat
Update 01/31/2024 We update the OpenAI Moderation API results for ToxicChat (0124) based on their updated moderation model…
CADS-dataset
CADS: A Comprehensive Anatomical Dataset and Segmentation for Whole-Body Anatomy in Computed Tomography Overview CADS is a robust,…
PopQA
Dataset Card for PopQA Dataset Summary PopQA is a large-scale open-domain question answering (QA) dataset, consisting of 14k…