Small Vision-Language Models are Smart Compressors for Long Video Understanding
Junjie Fei ⋅ Jun Chen ⋅ Zechun Liu ⋅ Yunyang Xiong ⋅ Chong Zhou ⋅ Wei Wen ⋅ Junlin Han ⋅ Mingchen Zhuge ⋅ Saksham Suri ⋅ Qi Qian ⋅ Shuming Liu ⋅ Lemeng Wu ⋅ Raghuraman Krishnamoorthi ⋅ Vikas Chandra ⋅ Mohamed Elhoseiny ⋅ Chenchen Zhu
Successful Page Load