Computer Vision and Pattern Recognition · Computer Science
ComicsPAP: understanding comic strips by picking the correct panel
Emanuele Vivoli, Artemis Llabrés, Mohamed Ali Souibgui, Marco Bertini +2
2025-10-02
Computation and Language · Computer Science
I Came, I Saw, I Explained: Benchmarking Multimodal LLMs on Figurative Meaning in Memes
Shijia Zhou, Saif M. Mohammad, Barbara Plank, Diego Frassinelli
2026-03-25
Computer Vision and Pattern Recognition · Computer Science
D-HUMOR: Dark Humor Understanding via Multimodal Open-ended Reasoning -- A Benchmark Dataset and Method
Sai Kartheek Reddy Kasu, Mohammad Zia Ur Rehman, Shahid Shafi Dar, Rishi Bharat Junghare +2
2025-10-31
Computation and Language · Computer Science
Which LLMs Get the Joke? Probing Non-STEM Reasoning Abilities with HumorBench
Reuben Narad, Siddharth Suresh, Jiayi Chen, Pine S. L. Dysart-Bricken +4
2025-07-30
Computer Vision and Pattern Recognition · Computer Science
PunchBench: Benchmarking MLLMs in Multimodal Punchline Comprehension
Kun Ouyang, Yuanxin Liu, Shicheng Li, Yi Liu +4
2025-06-18
Computation and Language · Computer Science
Bridging the Creativity Understanding Gap: Small-Scale Human Alignment Enables Expert-Level Humor Ranking in LLMs
Kuan Lok Zhou, Jiayi Chen, Siddharth Suresh, Reuben Narad +5
2025-02-28
Computer Vision and Pattern Recognition · Computer Science
PixelLM: Pixel Reasoning with Large Multimodal Model
Zhongwei Ren, Zhicheng Huang, Yunchao Wei, Yao Zhao +3
2024-07-19
Computer Vision and Pattern Recognition · Computer Science
v-HUB: A Benchmark for Video Humor Understanding from Vision and Sound
Zhengpeng Shi, Yanpeng Zhao, Jianqun Zhou, Yuxuan Wang +5
2026-03-11
Computation and Language · Computer Science
A Survey on Benchmarks of Multimodal Large Language Models
Jian Li, Weiheng Lu, Hao Fei, Meng Luo +10
2024-09-09
Graphics · Computer Science
Towards Understanding Graphical Perception in Large Multimodal Models
Kai Zhang, Jianwei Yang, Jeevana Priya Inala, Chandan Singh +3
2025-03-17
Computation and Language · Computer Science
Comparing Apples to Oranges: A Dataset & Analysis of LLM Humour Understanding from Traditional Puns to Topical Jokes
Tyler Loakman, William Thorne, Chenghua Lin
2025-09-15
Artificial Intelligence · Computer Science
A Survey on Multimodal Benchmarks: In the Era of Large AI Models
Lin Li, Guikun Chen, Hanrong Shi, Jun Xiao +1
2024-09-30
Computation and Language · Computer Science
MangaVQA and MangaLMM: A Benchmark and Specialized Model for Multimodal Manga Understanding
Jeonghun Baek, Kazuki Egashira, Shota Onohara, Atsuyuki Miyai +3
2026-01-27
Computer Vision and Pattern Recognition · Computer Science
MMR: Evaluating Reading Ability of Large Multimodal Models
Jian Chen, Ruiyi Zhang, Yufan Zhou, Ryan Rossi +2
2024-08-28
Computation and Language · Computer Science
Beyond Single Frames: Can LMMs Comprehend Temporal and Contextual Narratives in Image Sequences?
Xiaochen Wang, Heming Xia, Jialin Song, Longyu Guan +8
2025-10-10
Computation and Language · Computer Science
Cracking the Code of Juxtaposition: Can AI Models Understand the Humorous Contradictions
Zhe Hu, Tuo Liang, Jing Li, Yiren Lu +4
2026-04-16
Computation and Language · Computer Science
Hummus: A Dataset of Humorous Multimodal Metaphor Use
Xiaoyu Tong, Zhi Zhang, Pia Sommerauer, Martha Lewis +1
2026-01-21
Computation and Language · Computer Science
From Punchlines to Predictions: A Metric to Assess LLM Performance in Identifying Humor in Stand-Up Comedy
Adrianna Romanowski, Pedro H. V. Valois, Kazuhiro Fukui
2025-11-25
Computer Vision and Pattern Recognition · Computer Science
When 'YES' Meets 'BUT': Can Large Models Comprehend Contradictory Humor Through Comparative Reasoning?
Tuo Liang, Zhe Hu, Jing Li, Hao Zhang +7
2026-04-16
Computer Vision and Pattern Recognition · Computer Science
SciFIBench: Benchmarking Large Multimodal Models for Scientific Figure Interpretation
Jonathan Roberts, Kai Han, Neil Houlsby, Samuel Albanie
2024-12-06
Computation and Language · Computer Science
"I See What You Did There": Can Large Vision-Language Models Understand Multimodal Puns?
Naen Xu, Jiayi Sheng, Changjiang Li, Chunyi Zhou +6
2026-04-08
Machine Learning · Computer Science
Semantic Similarity is a Spurious Measure of Comic Understanding: Lessons Learned from Hallucinations in a Benchmarking Experiment
Christopher Driggers-Ellis, Nachiketh Tibrewal, Rohit Bogulla, Harsh Khanna +3
2026-03-03
Computation and Language · Computer Science
MultiChartQA: Benchmarking Vision-Language Models on Multi-Chart Problems
Zifeng Zhu, Mengzhao Jia, Zhihan Zhang, Lang Li +1
2025-02-11
Computer Vision and Pattern Recognition · Computer Science
Monkey: Image Resolution and Text Label Are Important Things for Large Multi-modal Models
Zhang Li, Biao Yang, Qiang Liu, Zhiyin Ma +5
2024-08-27