中文

基于机器学习与嵌入的阿塞拜疆语文本分类

计算与语言 2020-01-01 v1 机器学习 机器学习

摘要

文本分类系统将有助于解决阿塞拜疆语中的文本聚类问题。针对外语已有一些文本分类应用,但我们试图构建一个新开发的系统来解决阿塞拜疆语的这一问题。首先,我们试图找出潜在的应用领域。该系统在许多领域都将有用,最主要将用于新闻馈送分类。新闻网站可将新闻自动分类为体育、商业、教育、科学等类别。该系统也用于产品评论的情感分析。例如,公司在 Facebook 上分享新产品的照片并收到上千条评论,系统将评论分类为正面或负面等类别。该系统还可应用于推荐系统、垃圾邮件过滤等。为解决阿塞拜疆语文本分类问题,已设计多种机器学习技术,如朴素贝叶斯、SVM、决策树。

关键词

引用

@article{arxiv.1912.13362,
  title  = {Text Classification for Azerbaijani Language Using Machine Learning and Embedding},
  author = {Umid Suleymanov and Behnam Kiani Kalejahi and Elkhan Amrahov and Rashid Badirkhanli},
  journal= {arXiv preprint arXiv:1912.13362},
  year   = {2020}
}