ReVA uses image regions to reduce visual hallucinations in question-answering models
A new region-aware visual question-answering system reports a modest improvement in detecting unsupported object claims by giving a language model both whole-image and region-level visual evidence.