NUIG-Shubhanker@Dravidian-CodeMix-FIRE2020:基于XLNet的达罗毗荼语码混合文本情感分析
计算与语言
2020-10-16 v1 人工智能
机器学习
神经与进化计算
摘要
社交媒体已深入多语言社会,然而其中大多数将英语作为偏好的交流语言。因此,他们在对话中自然地将本族语言与英语混合,导致当今世界上存在大量多语言数据,称之为码混合数据。由于此类数据的语义特性跨越多种语言,利用其开展下游NLP任务具有挑战性。其中一个此类自然语言处理任务是情感分析,为此我们使用自回归XLNet模型对码混合的泰米尔语-英语和马来亚拉姆语-英语数据集进行情感分析。
引用
@article{arxiv.2010.07773,
title = {NUIG-Shubhanker@Dravidian-CodeMix-FIRE2020: Sentiment Analysis of Code-Mixed Dravidian text using XLNet},
author = {Shubhanker Banerjee and Arun Jayapal and Sajeetha Thavareesan},
journal= {arXiv preprint arXiv:2010.07773},
year = {2020}
}
备注
7 pages