Skip to content
arXiv cs.AI · Papers

Test-Time Scaling for Small VLMs on Multilingual Visual MCQ

arXiv:2607.09438v1 Announce Type: cross Abstract: Test-time scaling (TTS) reliably improves reasoning in large language models, but whether it transfers to small open vision-language models remains unclear. We examine this on EXAMS-V, a multilingual visual multiple-choice benchmark, comparing self-consistency, describe