利用大型语言模型实现自动定义提取:TaxoMatic在媒体偏见领域的案例研究
计算与语言
2025-04-02 v1
摘要
本文介绍TaxoMatic,一个利用大型语言模型自动从学术文献中提取定义的框架。本研究聚焦于媒体偏见领域,框架涵盖数据收集、LLM驱动的相关性分类以及概念定义的提取。该研究在2,398篇手动评分文章的数据集上进行评估,结果表明TaxoMatic在相关性分类和定义提取方面均取得优异成绩,Claude-3-sonnet模型取得最佳效果。未来方向包括扩大数据集规模并将TaxoMatic应用于更多领域。
引用
@article{arxiv.2504.00343,
title = {Leveraging Large Language Models for Automated Definition Extraction with TaxoMatic A Case Study on Media Bias},
author = {Timo Spinde and Luyang Lin and Smi Hinterreiter and Isao Echizen},
journal= {arXiv preprint arXiv:2504.00343},
year = {2025}
}