SHOVIR: A Benchmark for Evaluating Vision Shortcut Learning in Radiology Report Generation
arXiv:2606.30201v1 Announce Type: cross Abstract: Current evaluation protocols for Vision-Language Models (VLMs) in Radiology Report Generation (RRG) rely on report-level metrics that measure lexical overlap or…