arXiv cs.AI
· Papers
RobustVLA: On Robustness of Vision-Language-Action Model against Multi-Modal Perturbations
arXiv:2510.00037v5 Announce Type: replace-cross Abstract: In Vision-Language-Actionf(VLA) models, robustness to real-world perturbations is critical for deployment. Existing methods target simple visual disturbances, overlooking the broader multi-modal perturbations that arise in actions, instructions, environments, an