中文

利用大型语言模型实现自动定义提取:TaxoMatic在媒体偏见领域的案例研究

计算与语言 2025-04-02 v1

摘要

本文介绍TaxoMatic,一个利用大型语言模型自动从学术文献中提取定义的框架。本研究聚焦于媒体偏见领域,框架涵盖数据收集、LLM驱动的相关性分类以及概念定义的提取。该研究在2,398篇手动评分文章的数据集上进行评估,结果表明TaxoMatic在相关性分类和定义提取方面均取得优异成绩,Claude-3-sonnet模型取得最佳效果。未来方向包括扩大数据集规模并将TaxoMatic应用于更多领域。

关键词

引用

@article{arxiv.2504.00343,
  title  = {Leveraging Large Language Models for Automated Definition Extraction with TaxoMatic A Case Study on Media Bias},
  author = {Timo Spinde and Luyang Lin and Smi Hinterreiter and Isao Echizen},
  journal= {arXiv preprint arXiv:2504.00343},
  year   = {2025}
}