Image Classifiers are Efficient Self-Supervised Video Learners
Researchers introduce VideoMSN, a Masked Siamese Network framework designed for efficient self-supervised spatio-temporal representation learning in videos
Researchers introduce VideoMSN, a Masked Siamese Network framework designed for efficient self-supervised spatio-temporal representation learning in videos