中文

面向多语言情感分析的混合抽取-生成式摘要

计算与语言 2025-06-10 v1

摘要

我们提出了一种混合方法,用于多语言情感分析,将抽取式摘要与生成式摘要结合,以解决单一方法的局限性。该模型集成了基于 TF-IDF 的抽取与微调的 XLM-R 生成式模块,后者通过动态阈值和文化适应性得到增强。跨 10 种语言的实验显示,显著优于基线方法,英语准确率达 0.90,低资源语言达 0.84。该方法还比传统方法在计算效率上提高了 22%。实际应用包括实时品牌监测和跨文化话语分析。未来工作将重点优化面向低资源语言的 8 位量化。

关键词

引用

@article{arxiv.2506.06929,
  title  = {Hybrid Extractive Abstractive Summarization for Multilingual Sentiment Analysis},
  author = {Mikhail Krasitskii and Grigori Sidorov and Olga Kolesnikova and Liliana Chanona Hernandez and Alexander Gelbukh},
  journal= {arXiv preprint arXiv:2506.06929},
  year   = {2025}
}

备注

6 pages