中文

利用众包识别社会经济地位的代理指标

计算机与社会 2019-02-20 v1

摘要

社交媒体为研究者提供了前所未有的机会,以洞察人类生活的各个方面。健康从业者非常重视确定个体的社会经济地位(SES),因为他们可借此预测某些疾病。众包(crowdsourcing)一词意指从在线用户群体中收集信息。为了将在线用户分组为社群,研究者利用了能汇集某用户群体兴趣的话题标签。本文提出一种机制,基于用户的地理背景将其分组,并为这类用户构建语料库。具体而言,我们考察了某些车辆的讨论论坛,其中网站为不同地区建立了社群以表达对该车辆的抱怨或赞扬。从此类讨论中,可以收集到这些用户群体所使用的词汇。我们比较了不同社群的语料库,注意到其语言选择的差异。这为我们预测此类社群的社会经济地位奠定了基础,对健康从业者尤为有用,并可进而应用于智慧城市,以向社群成员提供更好的服务。更多工作正在进行中,以处理词汇表外的词和表情符号(OOV)并将平均得分作为特例进行评估。

关键词

引用

@article{arxiv.1902.06914,
  title  = {Using Crowdsourcing to Identify a Proxy of Socio-Economic status},
  author = {Adil E. Rajput and Akila Sarirete and Tamer F. Desouky},
  journal= {arXiv preprint arXiv:1902.06914},
  year   = {2019}
}