中文

IIT Gandhinagar 在 SemEval-2020 任务 9 上的工作:使用候选句生成与选择的混合语码情感分类

计算与语言 2020-07-24 v3

摘要

语码混合是指在同一文本或语音话语中使用多种语言的现象。它是在社交媒体网站、在线游戏、产品评论等各种平台上常用的交流模式。单语文本的情感分析是一项被充分研究的任务。由于非标准书写风格,语码混合增加了分析文本情感的挑战。我们提出一种基于候选句生成与选择、构建于 Bi-LSTM 神经分类器之上的方法,将 Hinglish 混合语码文本分类为积极、消极或中性三种情感类别之一。与基于 Bi-LSTM 的神经分类器相比,所提方法显示了系统性能的提升。结果提供了理解文本数据中语码混合其他各种细微之处(如幽默检测、意图分类等)的机会。

关键词

引用

@article{arxiv.2006.14465,
  title  = {IIT Gandhinagar at SemEval-2020 Task 9: Code-Mixed Sentiment Classification Using Candidate Sentence Generation and Selection},
  author = {Vivek Srivastava and Mayank Singh},
  journal= {arXiv preprint arXiv:2006.14465},
  year   = {2020}
}