语言模型是否对语言导向扰动不敏感?以印度语言为例的案例研究
计算与语言
2024-12-17 v1
摘要
预训练语言模型 (PLMs) 已知对输入文本的扰动十分敏感,但现有研究未显著关注语言导向的攻击,这类攻击虽微小,却在自然界中十分常见。本文我们研究 PLMs 是否对语言导向的攻击不敏感。为此,我们提供首个针对此问题的研究,探讨不同印度语言及各种下游任务。我们的发现表明,尽管 PLMs 对语言扰动仍较敏感,但与非语言攻击相比,PLMs 对语言攻击的敏感性略低。这凸显了即便是受限攻击亦具有效性。此外,我们还探讨了这些结果在不同语言中的意义,涵盖多样语言家族及不同脚本。
引用
@article{arxiv.2412.10805,
title = {Are Language Models Agnostic to Linguistically Grounded Perturbations? A Case Study of Indic Languages},
author = {Poulami Ghosh and Raj Dabre and Pushpak Bhattacharyya},
journal= {arXiv preprint arXiv:2412.10805},
year = {2024}
}
备注
Work in Progress