RoboSPA Benchmark Evaluates Spatial-Procedural Reasoning in VLA Models
September 7, 2026
RoboSPA is a large-scale dataset of 527K trajectories designed to test Vision-Language-Action models on fine-grained spatial reasoning and long-horizon planning. It features 280 task variants across 10 categories with increasing complexity.
HOW THIS AFFECTS YOU
●
builderThis provides a more rigorous testing framework for robotic control agents.
●
researcherUse this benchmark to move beyond simple task-completion metrics for embodied AI.