Computer Vision and Pattern Recognition · Computer Science
Contrastive Masked Autoencoders are Stronger Vision Learners
Zhicheng Huang, Xiaojie Jin, Chengze Lu, Qibin Hou +4
2024-01-30
Computer Vision and Pattern Recognition · Computer Science
ViC-MAE: Self-Supervised Representation Learning from Images and Video with Contrastive Masked Autoencoders
Jefferson Hernandez, Ruben Villegas, Vicente Ordonez
2024-10-04
Computer Vision and Pattern Recognition · Computer Science
Self-supervised Video Representation Learning with Motion-Aware Masked Autoencoders
Haosen Yang, Deng Huang, Bin Wen, Jiannan Wu +4
2022-10-11
Multimedia · Computer Science
Contrastive Audio-Visual Masked Autoencoder
Yuan Gong, Andrew Rouditchenko, Alexander H. Liu, David Harwath +3
2023-04-13
Computer Vision and Pattern Recognition · Computer Science
ConvMAE: Masked Convolution Meets Masked Autoencoders
Peng Gao, Teli Ma, Hongsheng Li, Ziyi Lin +2
2022-05-20
Computer Vision and Pattern Recognition · Computer Science
Deep Feature Consistent Variational Autoencoder
Xianxu Hou, Linlin Shen, Ke Sun, Guoping Qiu
2024-03-21
Computer Vision and Pattern Recognition · Computer Science
Bringing Masked Autoencoders Explicit Contrastive Properties for Point Cloud Self-Supervised Learning
Bin Ren, Guofeng Mei, Danda Pani Paudel, Weijie Wang +5
2024-07-09
Computer Vision and Pattern Recognition · Computer Science
Masked Autoencoders Are Scalable Vision Learners
Kaiming He, Xinlei Chen, Saining Xie, Yanghao Li +2
2021-12-21
Computer Vision and Pattern Recognition · Computer Science
Mixed Autoencoder for Self-supervised Visual Representation Learning
Kai Chen, Zhili Liu, Lanqing Hong, Hang Xu +2
2024-02-08
Computer Vision and Pattern Recognition · Computer Science
Concatenated Masked Autoencoders as Spatial-Temporal Learner
Zhouqiang Jiang, Bowen Wang, Tong Xiang, Zhaofeng Niu +3
2023-12-15
Computer Vision and Pattern Recognition · Computer Science
Learning Comprehensive Motion Representation for Action Recognition
Mingyu Wu, Boyuan Jiang, Donghao Luo, Junchi Yan +6
2021-03-24
Computer Vision and Pattern Recognition · Computer Science
CrossVideoMAE: Self-Supervised Image-Video Representation Learning with Masked Autoencoders
Shihab Aaqil Ahamed, Malitha Gunawardhana, Liel David, Michael Sidorov +2
2025-02-13
Computer Vision and Pattern Recognition · Computer Science
CoMA: Complementary Masking and Hierarchical Dynamic Multi-Window Self-Attention in a Unified Pre-training Framework
Jiaxuan Li, Qing Xu, Xiangjian He, Ziyu Liu +5
2025-11-11
Computer Vision and Pattern Recognition · Computer Science
VideoMAC: Video Masked Autoencoders Meet ConvNets
Gensheng Pei, Tao Chen, Xiruo Jiang, Huafeng Liu +2
2024-03-01
Computer Vision and Pattern Recognition · Computer Science
Large Motion Video Autoencoding with Cross-modal Video VAE
Yazhou Xing, Yang Fei, Yingqing He, Jingye Chen +3
2024-12-24
Computer Vision and Pattern Recognition · Computer Science
MV2MAE: Multi-View Video Masked Autoencoders
Ketul Shah, Robert Crandall, Jie Xu, Peng Zhou +3
2024-01-30
Computer Vision and Pattern Recognition · Computer Science
Mimic before Reconstruct: Enhancing Masked Autoencoders with Feature Mimicking
Peng Gao, Renrui Zhang, Rongyao Fang, Ziyi Lin +3
2023-03-10
Computer Vision and Pattern Recognition · Computer Science
From Semantics to Pixels: Coarse-to-Fine Masked Autoencoders for Hierarchical Visual Understanding
Wenzhao Xiang, Yue Wu, Hongyang Yu, Feng Gao +2
2026-03-11
Image and Video Processing · Electrical Eng. & Systems
Self Pre-training with Adaptive Mask Autoencoders for Variable-Contrast 3D Medical Imaging
Badhan Kumar Das, Gengyan Zhao, Han Liu, Thomas J. Re +3
2025-06-03
Computer Vision and Pattern Recognition · Computer Science
Social-MAE: A Transformer-Based Multimodal Autoencoder for Face and Voice
Hugo Bohy, Minh Tran, Kevin El Haddad, Thierry Dutoit +1
2025-08-26
Computer Vision and Pattern Recognition · Computer Science
Contrastive Masked Autoencoders for Character-Level Open-Set Writer Identification
Xiaowei Jiang, Wenhao Ma, Yiqun Duan, Thomas Do +1
2025-01-22
Computer Vision and Pattern Recognition · Computer Science
ViT-AE++: Improving Vision Transformer Autoencoder for Self-supervised Medical Image Representations
Chinmay Prabhakar, Hongwei Bran Li, Jiancheng Yang, Suprosana Shit +2
2023-05-17