ICPR 2024 多语言主张-span 识别竞赛
计算与语言
2024-12-02 v1
摘要
社交媒体帖子中会提出许多主张,这些主张可能包含误information 或假新闻。因此,识别主张作为主张验证的第一步至关重要。鉴于帖子的庞大数量,识别主张的任务需要自动化。本次竞赛涉及“主张-span 识别”任务,即在给定文本中识别对应主张的部分/span。该任务比将文本二元分类为主张或非主张更具挑战性,需要 Pattern Recognition、自然语言处理和机器学习的最新方法。对于本次竞赛,我们使用了一个新开发的数据集,称为 HECSI,包含约 8000 篇英文帖子和约 8000 篇 Hindi 语言帖子,由人工标注者标记主张-span。本文概述了本次竞赛情况,以及参赛队所开发的解决方案。
引用
@article{arxiv.2411.19579,
title = {ICPR 2024 Competition on Multilingual Claim-Span Identification},
author = {Soham Poddar and Biswajit Paul and Moumita Basu and Saptarshi Ghosh},
journal= {arXiv preprint arXiv:2411.19579},
year = {2024}
}
备注
To appear at ICPR 2024