ViTexQA: A Multi-Frame Temporal Perception Dataset for Video Text Question Answering
Zhentao Guo ⋅ Chen Duan ⋅ Tongkun Guan ⋅ Zining Wang ⋅ Kai zhou ⋅ Pengfei Yan
Successful Page Load