Foveated Reasoning: Stateful, Action-based Visual Focusing for Vision-Language Models
Juhong Min ⋅ Lazar Valkov ⋅ Vitali Petsiuk ⋅ Hossein Souri ⋅ Deen Dayal Mohan
Successful Page Load