语言模型能像聊天机器人一样理解词义吗?语言模型内外不一致性的实证研究
计算与语言
2024-09-24 v1
摘要
当前与语言模型的常见交互是通过完整推理进行的。这种方法不一定与模型的内部知识相一致。研究表明提示与内部表示之间存在差异。大多数研究关注句子理解。我们研究了仅编码器、仅解码器和编码器-解码器预训练语言模型在内部与外部不一致性中词义理解的差异。
引用
@article{arxiv.2409.13972,
title = {Can Language Model Understand Word Semantics as A Chatbot? An Empirical Study of Language Model Internal External Mismatch},
author = {Jinman Zhao and Xueyan Zhang and Xingyu Yue and Weizhe Chen and Zifan Qian and Ruiyu Wang},
journal= {arXiv preprint arXiv:2409.13972},
year = {2024}
}
备注
10 pages, 1 figure, 5 tables