马其顿语文本文档的情感挖掘
计算与语言
2014-11-18 v1
摘要
从评论网站、社交网络和博客等网络门户中提取公众舆论的能力,将使公司和个人无需进行漫长且昂贵的研究和调查即可形成观点、态度并做出决策。本文利用机器学习技术来确定用马其顿语编写的 kajgana 论坛帖子的极性。帖子被分类为正面、负面或中性。我们测试了不同的特征度量和分类器,并在人工生成的数据集上详细评估了它们对提高整体性能的贡献。通过达到 92% 的准确率,我们表明自动化情感挖掘系统的性能可与人工评估者相媲美,从而使其成为文本数据分析的可行选项。最后,我们展示了利用所开发系统从论坛帖子中得出的一些统计数据。
引用
@article{arxiv.1411.4472,
title = {Opinion mining of text documents written in Macedonian language},
author = {Andrej Gajduk and Ljupco Kocarev},
journal= {arXiv preprint arXiv:1411.4472},
year = {2014}
}
备注
In press, MASA proceedings