Any To Any
16 results
ImageMultimodalText
Zebra-CoT
Zebra‑CoT A diverse large-scale dataset for interleaved vision‑language reasoning traces. Dataset Description Zebra‑CoT is a diverse large‑scale…
100K–1M·CC-BY-NC·Parquet
3D / Point CloudAudioImage
Creative Professionals Agentic Tasks (1M)
Creative Professionals Agentic Tasks (1M)
1M–10M·MIT·Parquet
3D / Point CloudAudioImage
Creative Professionals Agentic Tasks (1M)
Creative Professionals Agentic Tasks (1M)
1M–10M·MIT·Parquet
3D / Point CloudAudioImage
Edge Agent Reasoning WebSearch 260K
Edge Agent Reasoning WebSearch 260K
100K–1M·MIT·Parquet
3D / Point CloudAudioImage
Edge Agent Reasoning WebSearch 260K
Edge Agent Reasoning WebSearch 260K
100K–1M·MIT·Parquet
3D / Point CloudAudioImage
Edge Agent Reasoning WebSearch 260K
Edge Agent Reasoning WebSearch 260K
100K–1M·MIT·Parquet
3D / Point CloudAudioImage
Emergence-Text-Image-Audio-3D
Emergence: The Four Forms of Intelligence Summary A multimodal dataset that unifies Text, Image, Audio, and 3D modalities…
10K–100K·CC-BY·Parquet
3D / Point CloudAudioImage
Edge Agent Reasoning WebSearch 260K
Edge Agent Reasoning WebSearch 260K
100K–1M·MIT·Parquet
3D / Point CloudAudioImage
Edge Agent Reasoning WebSearch 260K
Edge Agent Reasoning WebSearch 260K
100K–1M·MIT·Parquet
3D / Point CloudAudioImage
Edge Agent Reasoning WebSearch 260K
Edge Agent Reasoning WebSearch 260K
100K–1M·MIT·Parquet
3D / Point CloudAudioImage
Edge Agent Reasoning WebSearch 260K
Edge Agent Reasoning WebSearch 260K
100K–1M·MIT·Parquet
3D / Point CloudAudioImage
Creative Professionals Agentic Tasks (1M)
Creative Professionals Agentic Tasks (1M)
1M–10M·MIT·Parquet
3D / Point Cloud
NeurCross Per-Mesh Generated Labels
NeurCross Per-Mesh Generated Labels
100M–1B·AGPL-3.0