Skip to content
arXiv cs.CV · Papers

Layer-Specific Prompt Fusion Discovery via Differentiable Search in Vision Foundation Models

arXiv:2606.26379v1 Announce Type: new Abstract: Visual prompt tuning has emerged as a parameter-efficient fine-tuning approach for adapting large-scale Vision Transformers (ViTs) to downstream tasks. As its learnable prompts are applied in input and feature spaces, prior to jointly going through attention in transforme