Get our free extension to see links to code for papers anywhere online!Free add-on: code for papers everywhere!Free add-on: See code for papers anywhere!

Add to Chrome

Add to Firefox

Add to Edge

Title:Improving video retrieval using multilingual knowledge transfer

Aug 28, 2022

Avinash Madasu, Estelle Aflalo, Gabriela Ben Melech Stan, Shao-Yen Tseng, Gedas Bertasius, Vasudev Lal

Figure 1 for Improving video retrieval using multilingual knowledge transfer

Figure 2 for Improving video retrieval using multilingual knowledge transfer

Figure 3 for Improving video retrieval using multilingual knowledge transfer

Figure 4 for Improving video retrieval using multilingual knowledge transfer

Share this with someone who'll enjoy it:

Abstract:Video retrieval has seen tremendous progress with the development of vision-language models. However, further improving these models require additional labelled data which is a huge manual effort. In this paper, we propose a framework MKTVR, that utilizes knowledge transfer from a multilingual model to boost the performance of video retrieval. We first use state-of-the-art machine translation models to construct pseudo ground-truth multilingual video-text pairs. We then use this data to learn a video-text representation where English and non-English text queries are represented in a common embedding space based on pretrained multilingual models. We evaluate our proposed approach on four English video retrieval datasets such as MSRVTT, MSVD, DiDeMo and Charades. Experimental results demonstrate that our approach achieves state-of-the-art results on all datasets outperforming previous models. Finally, we also evaluate our model on a multilingual video-retrieval dataset encompassing six languages and show that our model outperforms previous multilingual video retrieval models in a zero-shot setting.

View paper on

Share this with someone who'll enjoy it:

Title:Improving video retrieval using multilingual knowledge transfer

Paper and Code