Human-Computer Interaction · Computer Science
Audio Description Customization
Rosiana Natalie, Ruei-Che Chang, Smitha Sheshadri, Anhong Guo +1
2024-08-22
Human-Computer Interaction · Computer Science
"It's Kind of Context Dependent": Understanding Blind and Low Vision People's Video Accessibility Preferences Across Viewing Scenarios
Lucy Jiang, Crescentia Jung, Mahika Phutane, Abigale Stangl +1
2024-03-19
Human-Computer Interaction · Computer Science
ADCanvas: Accessible and Conversational Audio Description Authoring for Blind and Low Vision Creators
Franklin Mingzhe Li, Michael Xieyang Liu, Cynthia L. Bennett, Shaun K. Kane
2026-02-10
Human-Computer Interaction · Computer Science
DescribePro: Collaborative Audio Description with Human-AI Interaction
Maryam Cheema, Sina Elahimanesh, Samuel Martin, Pooyan Fazli +1
2025-08-05
Human-Computer Interaction · Computer Science
ADx3: A Collaborative Workflow for High-Quality Accessible Audio Description
Lana Do, Shasta Ihorn, Charity Pitcher-Cooper, Juvenal Francisco Barajas +4
2026-02-04
Human-Computer Interaction · Computer Science
ViDscribe: Multimodal AI for Customizing Audio Description and Question Answering in Online Videos
Maryam Cheema, Sina Elahimanesh, Pooyan Fazli, Hasti Seifi
2026-03-17
Computation and Language · Computer Science
Audio Description Generation in the Era of LLMs and VLMs: A Review of Transferable Generative AI Technologies
Yingqiang Gao, Lukas Fischer, Alexa Lintner, Sarah Ebling
2024-10-14
Computer Vision and Pattern Recognition · Computer Science
VideoA11y: Method and Dataset for Accessible Video Description
Chaoyu Li, Sid Padmanabhuni, Maryam Cheema, Hasti Seifi +1
2025-03-03
Human-Computer Interaction · Computer Science
SPICA: Interactive Video Content Exploration through Augmented Audio Descriptions for Blind or Low-Vision Viewers
Zheng Ning, Brianna L. Wimer, Kaiwen Jiang, Keyi Chen +4
2024-02-28
Computer Vision and Pattern Recognition · Computer Science
Contextual AD Narration with Interleaved Multimodal Sequence
Hanlin Wang, Zhan Tong, Kecheng Zheng, Yujun Shen +1
2025-04-16
Human-Computer Interaction · Computer Science
Investigating Use Cases of AI-Powered Scene Description Applications for Blind and Low Vision People
Ricardo Gonzalez, Jazmin Collins, Shiri Azenkot, Cynthia Bennett
2025-03-13
Computer Vision and Pattern Recognition · Computer Science
AutoAD II: The Sequel -- Who, When, and What in Movie Audio Description
Tengda Han, Max Bain, Arsha Nagrani, Gül Varol +2
2023-10-11
Computer Vision and Pattern Recognition · Computer Science
AutoAD-Zero: A Training-Free Framework for Zero-Shot Audio Description
Junyu Xie, Tengda Han, Max Bain, Arsha Nagrani +3
2024-11-25
Human-Computer Interaction · Computer Science
AVscript: Accessible Video Editing with Audio-Visual Scripts
Mina Huh, Saelyne Yang, Yi-Hao Peng, Xiang 'Anthony' Chen +2
2023-03-01
Computer Vision and Pattern Recognition · Computer Science
How Blind and Low-Vision Individuals Prefer Large Vision-Language Model-Generated Scene Descriptions
Na Min An, Eunki Kim, Wan Ju Kang, Sangryul Kim +2
2026-04-02
Computer Vision and Pattern Recognition · Computer Science
More than a Moment: Towards Coherent Sequences of Audio Descriptions
Eshika Khandelwal, Junyu Xie, Tengda Han, Max Bain +4
2025-10-30
Computer Vision and Pattern Recognition · Computer Science
NowYouSee Me: Context-Aware Automatic Audio Description
Seon-Ho Lee, Jue Wang, David Fan, Zhikang Zhang +4
2024-12-16
Computer Vision and Pattern Recognition · Computer Science
FocusedAD: Character-centric Movie Audio Description
Xiaojun Ye, Chun Wang, Yiren Song, Sheng Zhou +2
2025-05-13
Human-Computer Interaction · Computer Science
Toward Scalable Audio Description Quality Control: A Workflow for Evaluating Human and VLM Raters
Lana Do, Gio Jung, Juvenal Francisco Barajas, Andrew Taylor Scott +4
2026-05-08
Human-Computer Interaction · Computer Science
Making Videos Accessible for Blind and Low Vision Users Using a Multimodal Agent Video Player
Adriana Olmos, Anoop K. Sinha, Renelito Delos Santos, Ruben Rodriguez Rodriguez +4
2026-02-06