●builderYou can leverage large-scale human video datasets to train robot manipulation policies without manual data collection.
●researcherThis provides a scalable method for vision-language-action model pretraining using heterogeneous robot morphologies.