通过文本挖掘实时追踪 COVID-19 与冠状病毒研究进展
信息检索
2021-02-16 v1
摘要
导致 COVID-19 的新型冠状病毒(SARS-CoV-2)是一场持续中的大流行。相关研究持续推进,每日多达数百篇出版物上传至数据库。我们探索人工智能与自然语言处理在高效梳理这些出版物中的用例。我们证明,临床试验信息、临床前研究与一个通用主题模型可用作文本挖掘数据智能工具,供全球科学家作为其自身研究的资源。为评估我们的方法,采用若干指标衡量信息抽取与聚类结果。此外,我们证明我们的工作流不仅适用于 COVID-19,也适用于其他疾病领域。总体而言,我们的系统旨在让科学家更高效地研究冠状病毒。我们自动更新的模块可在信息门户 https://ghddi-ailab.github.io/Targeting2019-nCoV/ 公开查看。
引用
@article{arxiv.2102.07640,
title = {Real-time tracking of COVID-19 and coronavirus research updates through text mining},
author = {Yutong Jin and Jie Li and Xinyu Wang and Peiyao Li and Jinjiang Guo and Junfeng Wu and Dawei Leng and Lurong Pan},
journal= {arXiv preprint arXiv:2102.07640},
year = {2021}
}