Computer Vision and Pattern Recognition · Computer Science
ViBE: Visual-to-M/EEG Brain Encoding via Spatio-Temporal VAE and Distribution-Aligned Projection
Ganxi Xu, Zhao-Rong Lai, Yuting Tang, Yonghao Song +5
2026-04-30
Networking and Internet Architecture · Computer Science
Look Once, Beam Twice: Camera-Primed Real-Time Double-Directional mmWave Beam Management for Vehicular Connectivity
Avhishek Biswas, Apala Pramanik, Eylem Ekici, Mehmet C. Vuran
2026-05-07
Computer Vision and Pattern Recognition · Computer Science
Two-Stage Multimodal Framework for Emotion Mimicry Intensity Prediction
Dinithi Dissanayake, Shaveen Silva, Ovindu Atukorala, Prasanth Sasikumar +1
2026-05-22
Computer Vision and Pattern Recognition · Computer Science
Foundation Model Embeddings Meet Blended Emotions: A Multimodal Fusion Approach for the BLEMORE Challenge
Masoumeh Chapariniya, Aref Farhadipour, Sarah Ebling, Volker Dellwo +1
2026-03-26
Machine Learning · Computer Science
TRIBE: TRImodal Brain Encoder for whole-brain fMRI response prediction
Stéphane d'Ascoli, Jérémy Rapin, Yohann Benchetrit, Hubert Banville +1
2025-07-31
Computer Vision and Pattern Recognition · Computer Science
WAVE: Learning Unified & Versatile Audio-Visual Embeddings with Multimodal LLM
Changli Tang, Qinfan Xiao, Ke Mei, Tianyi Wang +2
2026-02-24
Neurons and Cognition · Quantitative Biology
A foundation model of vision, audition, and language for in-silico neuroscience
Stéphane d'Ascoli, Jérémy Rapin, Yohann Benchetrit, Teon Brooks +4
2026-05-07
Computer Vision and Pattern Recognition · Computer Science
OmniEncoder: See, Hear, and Feel Continuous Motion Like Humans With One Encoder
Detao Bai, Shimin Yao, Weixuan Chen, Chengen Lai +3
2026-05-05
Computer Vision and Pattern Recognition · Computer Science
Visio-Linguistic Brain Encoding
Subba Reddy Oota, Jashn Arora, Vijay Rowtula, Manish Gupta +1
2022-04-19
Audio and Speech Processing · Electrical Eng. & Systems
Attentive Fusion Enhanced Audio-Visual Encoding for Transformer Based Robust Speech Recognition
Liangfa Wei, Jie Zhang, Junfeng Hou, Lirong Dai
2020-08-07
Computer Vision and Pattern Recognition · Computer Science
Modality-Aware and Anatomical Vector-Quantized Autoencoding for Multimodal Brain MRI
Mingjie Li, Edward Kim, Yue Zhao, Ehsan Adeli +1
2026-04-08
Computer Vision and Pattern Recognition · Computer Science
How Well Do Models Follow Visual Instructions? VIBE: A Systematic Benchmark for Visual Instruction-Driven Image Editing
Huanyu Zhang, Xuehai Bai, Chengzu Li, Chen Liang +8
2026-05-22
Computation and Language · Computer Science
VibeVoice Technical Report
Zhiliang Peng, Jianwei Yu, Wenhui Wang, Yaoyao Chang +9
2025-08-27
Computer Vision and Pattern Recognition · Computer Science
Uni-Encoder Meets Multi-Encoders: Representation Before Fusion for Brain Tumor Segmentation with Missing Modalities
Peibo Song, Xiaotian Xue, Jinshuo Zhang, Zihao Wang +4
2026-04-27
Computer Vision and Pattern Recognition · Computer Science
MOVE: A Mixture-of-Vision-Encoders Approach for Domain-Focused Vision-Language Processing
Matvey Skripkin, Elizaveta Goncharova, Dmitrii Tarasov, Andrey Kuznetsov
2025-02-24
Computer Vision and Pattern Recognition · Computer Science
VLMo: Unified Vision-Language Pre-Training with Mixture-of-Modality-Experts
Hangbo Bao, Wenhui Wang, Li Dong, Qiang Liu +4
2022-05-30
Computer Vision and Pattern Recognition · Computer Science
NeuroCine: Decoding Vivid Video Sequences from Human Brain Activties
Jingyuan Sun, Mingxiao Li, Zijiao Chen, Marie-Francine Moens
2024-05-14
Computer Vision and Pattern Recognition · Computer Science
EVE: Efficient Vision-Language Pre-training with Masked Prediction and Modality-Aware MoE
Junyi Chen, Longteng Guo, Jia Sun, Shuai Shao +3
2024-03-04
Computer Vision and Pattern Recognition · Computer Science
Transformer-based Multimodal Information Fusion for Facial Expression Analysis
Wei Zhang, Feng Qiu, Suzhen Wang, Hao Zeng +4
2022-04-19
Computer Vision and Pattern Recognition · Computer Science
eMotions: A Large-Scale Dataset and Audio-Visual Fusion Network for Emotion Analysis in Short-form Videos
Xuecheng Wu, Dingkang Yang, Danlei Huang, Xinyi Yin +8
2025-08-12
Computer Vision and Pattern Recognition · Computer Science
Vision Bridge Transformer at Scale
Zhenxiong Tan, Zeqing Wang, Xingyi Yang, Songhua Liu +1
2025-12-01