中文

利用Reddit慢性疼痛报告数据集对在线慢性疼痛经历进行建模

计算与语言 2023-04-14 v4 信息检索 社会与信息网络 定量方法

摘要

目的:利用新颖的Reddit慢性疼痛报告(RRCP)数据集,通过自然语言处理技术,揭示并量化社交媒体上来自多种病理背景的慢性疼痛报告经历的特征。材料与方法:定义并验证一组与慢性疼痛相关的子版块(subreddit)的RRCP数据集。识别每个子版块中讨论的主要关切点。根据其主要关切点对每个子版块进行建模。比较各子版块模型。结果:RRCP数据集包含来自12个与慢性疼痛相关的子版块(每个子版块对应一种病理背景)的86,537份Reddit提交内容。每个RRCP子版块都有不同的主要关切点。其中一些关切点在多个子版块之间共享(例如,坐骨神经痛子版块在语义上蕴含了背痛子版块的多种关切点,但反之则不然),而有些关切点则是特定子版块独有的(例如,间质性膀胱炎和克罗恩病)。讨论:这些结果表明,来自多种病理(即子版块)的慢性疼痛报告经历,既有与所有病理相关的关切点,也有某些病理独有的关切点。我们的分析详细阐述了这些关切点及其相似性关系。结论:尽管受到Reddit平台固有特性的限制,但据我们所知,这是首个尝试对多种慢性疼痛诱发病理的语言表达进行建模,并比较这些模型以识别和量化相应涌现的慢性疼痛经历之间异同的研究工作。

关键词

引用

@article{arxiv.2108.10218,
  title  = {Modeling chronic pain experiences from online reports using the Reddit Reports of Chronic Pain dataset},
  author = {Diogo A. P. Nunes and Joana Ferreira-Gomes and Fani Neto and David Martins de Matos},
  journal= {arXiv preprint arXiv:2108.10218},
  year   = {2023}
}

备注

24 pages, 26 figures, 8 tables