如何构建具备可控问题生成器的鲁棒 FAQ 聊天机器人?
计算与语言
2021-12-07 v1 人工智能
摘要
许多无法回答的对抗性问题以看似合理的答案欺骗问答(QA)系统。构建鲁棒的常见问题(FAQ)聊天机器人需要大量多样化的对抗样本。现有的问题生成方法难以从非结构化文本中生成许多高质量且多样化的对抗性问答对。我们提出了多样性可控语义有效对抗攻击者(DCSA),一种基于语义图生成标准与对抗样本的高质量、多样化、可控方法。所生成的流畅且语义合理的问答对成功欺骗了我们的段落检索模型。此后,我们针对 QA 模型在不同领域间使用生成问答对的鲁棒性与泛化能力展开研究。我们发现,所生成的数据集提升了 QA 模型对新目标领域的泛化能力,以及检测无法回答的对抗性问题的鲁棒性。
引用
@article{arxiv.2112.03007,
title = {How to Build Robust FAQ Chatbot with Controllable Question Generator?},
author = {Yan Pan and Mingyang Ma and Bernhard Pflugfelder and Georg Groh},
journal= {arXiv preprint arXiv:2112.03007},
year = {2021}
}