Precise Video-to-Audio Generation with Cross-Modal Alignment in Latent Space
Thanh V. T. Tran ⋅ Ngoc-Son Nguyen ⋅ Luong Tran ⋅ Long-Khanh Pham ⋅ Paarth Neekhara ⋅ Shehzeen Hussain ⋅ Van Nguyen
Successful Page Load