BaIT:信息可信度晴雨表
机器学习
2023-02-24 v2 计算与语言
摘要
本文提出了一种用于 FNC-1 假新闻分类任务的新方法,该方法采用来自相似 NLP 任务(即句子相似度和自然语言推理)的预训练编码器模型,并基于此提出了两种神经网络架构。本文探索了数据增强方法,将其作为解决数据集中类别不平衡的一种手段,既使用了常见的已有方法,又提出了一种利用新颖的句子否定算法在代表性不足的类别中生成样本的方法。该方法取得了与现有基线相当的整体性能,同时显著提高了在 FNC-1 中代表性不足但十分重要的类别上的准确率。
引用
@article{arxiv.2206.07535,
title = {BaIT: Barometer for Information Trustworthiness},
author = {Oisín Nolan and Jeroen van Mourik and Callum Rhys Tilbury},
journal= {arXiv preprint arXiv:2206.07535},
year = {2023}
}