中文

自然语言处理中的外推

计算与语言 2018-05-18 v1

摘要

我们认为,对于捕捉全局结构而非仅仅最大化对训练数据的局部拟合的模型,外推到训练空间之外的样本往往更容易。我们证明对于两个流行模型:可分解注意力模型和 word2vec,这一结论成立。

关键词

引用

@article{arxiv.1805.06648,
  title  = {Extrapolation in NLP},
  author = {Jeff Mitchell and Pasquale Minervini and Pontus Stenetorp and Sebastian Riedel},
  journal= {arXiv preprint arXiv:1805.06648},
  year   = {2018}
}