irl-kit2026
SPARC VQA
A spatial visual question-answering dataset generated from robot demonstrations, containing 284,909 filtered examples with embedded images, questions, answers, and spatial reasoning annotations for training vision-language models.
Downloads0
Episodes284909
Why This Matters for Physical AI
SPARC VQA provides large-scale spatial reasoning annotations from robot demonstrations to train vision-language models that understand spatial relationships and can answer questions about robotic manipulation tasks.
Technical Profile
- Modalities
- rgblanguage
- Task Types
- spatial_reasoningvisual_question_answering
- Episodes
- 284909
- Data Format
- parquet
- Annotation Types
- language_instructionsspatial_coordinatestask_type_labelstarget_type_labels
Access
Need custom rgb data?
Claru builds purpose-built datasets for any environment applications with dense human annotations and quality assurance.
Request a Sample Pack