Human-Computer Interaction · Computer Science
Visual Affect Analysis: Predicting Emotions of Image Viewers with Vision-Language Models
Filip Nowicki, Hubert Marciniak, Jakub Łączkowski, Krzysztof Jassem +4
2026-02-03
Computer Vision and Pattern Recognition · Computer Science
Affective Image Content Analysis: Two Decades Review and New Perspectives
Sicheng Zhao, Xingxu Yao, Jufeng Yang, Guoli Jia +4
2021-07-01
Computer Vision and Pattern Recognition · Computer Science
Interpreting and Enhancing Emotional Circuits in Large Vision-Language Models via Cross-Modal Information Flow
Chengsheng Zhang, Chenghao Sun, Zhining Xie, Xinmei Tian
2026-05-22
Computer Vision and Pattern Recognition · Computer Science
VISTA-Bench: Do Vision-Language Models Really Understand Visualized Text as Well as Pure Text?
Qing'an Liu, Juntong Feng, Yuhao Wang, Xinzhe Han +5
2026-05-19
Human-Computer Interaction · Computer Science
Probing the Visualization Literacy of Vision Language Models: the Good, the Bad, and the Ugly
Lianghan Dong, Anamaria Crisan
2025-04-09
Computer Vision and Pattern Recognition · Computer Science
Visual Graph Arena: Evaluating Visual Conceptualization of Vision and Multimodal Large Language Models
Zahra Babaiee, Peyman M. Kiasari, Daniela Rus, Radu Grosu
2025-06-09
Computation and Language · Computer Science
Seeing is Believing: Emotion-Aware Audio-Visual Language Modeling for Expressive Speech Generation
Weiting Tan, Jiachen Lian, Hirofumi Inaguma, Paden Tomasello +2
2025-08-29
Computer Vision and Pattern Recognition · Computer Science
GIR-Bench: Versatile Benchmark for Generating Images with Reasoning
Hongxiang Li, Yaowei Li, Bin Lin, Yuwei Niu +6
2026-03-24
Computer Vision and Pattern Recognition · Computer Science
EPIC-Bench: A Perception-Centric Benchmark for Fine-Grained Embodied Visual Grounding in Vision-Language Models
Haozhe Shan, Xiancong Ren, Han Dong, Haoyuan Shi +8
2026-05-19
Computer Vision and Pattern Recognition · Computer Science
AVA-Bench: Atomic Visual Ability Benchmark for Vision Foundation Models
Zheda Mai, Arpita Chowdhury, Zihe Wang, Sooyoung Jeon +4
2026-05-05
Computer Vision and Pattern Recognition · Computer Science
Unveiling and Bridging the Functional Perception Gap in MLLMs: Atomic Visual Alignment and Hierarchical Evaluation via PET-Bench
Zanting Ye, Xiaolong Niu, Xuanbin Wu, Xu Han +13
2026-01-16
Multimedia · Computer Science
EEmo-Bench: A Benchmark for Multi-modal Large Language Models on Image Evoked Emotion Assessment
Lancheng Gao, Ziheng Jia, Yunhao Zeng, Wei Sun +4
2025-09-18
Computer Vision and Pattern Recognition · Computer Science
Analyzing Image Beyond Visual Aspect: Image Emotion Classification via Multiple-Affective Captioning
Zibo Zhou, Zhengjun Zhai, Huimin Chen, Wei Dai +1
2025-12-01
Computation and Language · Computer Science
Seeing is Not Understanding: A Benchmark on Perception-Cognition Disparities in Large Language Models
Haokun Li, Yazhou Zhang, Jizhi Ding, Qiuchi Li +1
2025-09-24
Computation and Language · Computer Science
PCA-Bench: Evaluating Multimodal Large Language Models in Perception-Cognition-Action Chain
Liang Chen, Yichi Zhang, Shuhuai Ren, Haozhe Zhao +6
2024-02-27
Computer Vision and Pattern Recognition · Computer Science
Seeing Is Believing? A Benchmark for Multimodal Large Language Models on Visual Illusions and Anomalies
Wenjin Hou, Wei Liu, Han Hu, Xiaoxiao Sun +2
2026-02-03
Computer Vision and Pattern Recognition · Computer Science
Facial-R1: Aligning Reasoning and Recognition for Facial Emotion Analysis
Jiulong Wu, Yucheng Shen, Lingyong Yan, Haixin Sun +3
2025-11-14
Computation and Language · Computer Science
MEMO-Bench: A Multiple Benchmark for Text-to-Image and Multimodal Large Language Models on Human Emotion Analysis
Yingjie Zhou, Zicheng Zhang, Jiezhang Cao, Jun Jia +5
2024-11-19
Computer Vision and Pattern Recognition · Computer Science
OIG-Bench: A Multi-Agent Annotated Benchmark for Multimodal One-Image Guides Understanding
Jiancong Xie, Wenjin Wang, Zhuomeng Zhang, Zihan Liu +4
2025-10-02
Computation and Language · Computer Science
VCG-Bench: Towards A Unified Visual-Centric Benchmark for Structured Generation and Editing
Xiaoyan Su, Peijie Dong, Zhenheng Tang, Song Tang +7
2026-05-18
Computer Vision and Pattern Recognition · Computer Science
Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning
Angelos Vlachos, Giorgos Filandrianos, Maria Lymperaiou, Nikolaos Spanos +3
2025-08-04
Artificial Intelligence · Computer Science
VTC-Bench: Evaluating Agentic Multimodal Models via Compositional Visual Tool Chaining
Xuanyu Zhu, Yuhao Dong, Rundong Wang, Yang Shi +8
2026-03-20
Computer Vision and Pattern Recognition · Computer Science
VOILA: Evaluation of MLLMs For Perceptual Understanding and Analogical Reasoning
Nilay Yilmaz, Maitreya Patel, Yiran Lawrence Luo, Tejas Gokhale +3
2026-02-26