过去与现在的蛛网:利用互联网档案数据提取大型社交网络
社会与信息网络
2017-01-13 v1 信息检索
物理与社会
摘要
由于应用潜力和涉及广泛的技术挑战,从各种来源构建社交图一直受到研究人员的关注。万维网提供了由各种内容提供者创建的关于广泛主题的大量持续更新数据和信息,使得提取的人物网络及其时间演变的研究对社会科学家和计算机科学家都很有价值。在本文中,我们提出 SocGraph——一个从 Internet Archive 在1996年至2013年17年间收集的约20亿网页内容中提取和探索社会关系的系统。我们描述了从提取的关系构建大型社交图的方法,并介绍了研究其时间演变的界面。
引用
@article{arxiv.1701.03277,
title = {Cobwebs from the Past and Present: Extracting Large Social Networks using Internet Archive Data},
author = {Miroslav Shaltev and Jan-Hendrik Zab and Philipp Kemkes and Stefan Siersdorfer and Sergej Zerr},
journal= {arXiv preprint arXiv:1701.03277},
year = {2017}
}
备注
5 pages, 5 figures, SIGIR '16, July 17-21, 2016, Pisa, Italy