arXiv cs.AI
· Papers
Controllable Video Object Insertion via Multi-View Priors
arXiv:2604.14556v2 Announce Type: replace-cross Abstract: Video object insertion places a user-specified object in an existing dynamic scene. Existing methods typically condition generation on text or a single reference image. Consequently, object appearance is underconstrained under viewpoint changes, often leading to