Skip to content
arXiv cs.CV · Papers

Rethinking Layer-Wise Information Allocation for Vision Foundation Model Adaptation

arXiv:2607.21973v1 Announce Type: new Abstract: Vision foundation models are increasingly reused as frozen backbones for downstream visual recognition, making parameter-efficient adaptation a central problem. Prompt-based adaptation, including Visual Prompt Tuning (VPT), provides a lightweight way to specialize these m