Benchmarking and fine-tuning vision-language models on a visual question answering dataset for myopic… | ScholarDeck