Medico 2025:胃肠镜成像的视觉问题解答
计算机视觉与模式识别
2025-08-15 v1 人工智能
摘要
Medico 2025挑战聚焦于视觉问题解答(VQA)用于胃肠镜(GI)成像,作为MediaEval任务系列的一部分组织。该挑战致力于开发解释人工智能(XAI)模型,这些模型基于GI内窥镜图像回答临床相关问题,同时提供与医学推理一致的可解释依据。它引入了两个子任务:(1)使用Kvasir-VQA-x1数据集回答多样化的视觉问题,以及(2)生成多模态解释以支持临床决策。来自6500张图像和159,549个复杂问题-答案(QA)对的Kvasir-VQA-x1数据集作为该挑战的基准。通过结合定量性能指标和专家审阅的可解释性评估,该任务旨在推动医学图像分析中可信的人工智能。指令、数据访问以及参赛指南的最新版本均可在官方竞赛存储库中获取:https://github.com/simula/MediaEval-Medico-2025
引用
@article{arxiv.2508.10869,
title = {Medico 2025: Visual Question Answering for Gastrointestinal Imaging},
author = {Sushant Gautam and Vajira Thambawita and Michael Riegler and Pål Halvorsen and Steven Hicks},
journal= {arXiv preprint arXiv:2508.10869},
year = {2025}
}