SIEVE: Structure-Aware Data Selection for Imitation Learning with VLA Models
Vision-Language-Action (VLA) models are typically trained by imitation learning on large-scale robot demonstration datasets, but more data does not necessarily yield better policies due to redundancy,…