AI Wizards at CheckThat! 2025:通过情感增强 Transformer 嵌入用于新闻文章主客观检测
计算与语言
2025-09-24 v1 信息检索
摘要
本文介绍了 AI Wizards 在 CLEF 2025 CheckThat! 实验室任务 1(新闻文章主客观检测)中的参与情况,任务目标是对句子进行主客观分类,涵盖单语种、多语种和零样种设置。训练/开发数据集提供阿拉伯语、德语、英语、意大利语和保加利亚语;最终评估包括额外的未见语言(如希腊语、罗马尼亚语、波兰语、乌克兰语),以评估泛化能力。我们的主要策略通过集成情感分数来增强基于 Transformer 的分类器,情感分数来源于辅助模型,旨在提升标准微调效果。我们以 mDeBERTaV3-base、ModernBERT-base(英语)和 Llama3.2-1B 进行情感增强架构的探索。为解决语言间常见的类别不平衡问题,我们采用在开发集上优化的决策阈值校准。实验表明,情感特征的集成显著提升了性能,尤其是主观 F1 分数。该框架实现了高峰排名,尤其是希腊语(宏观 F1 = 0.51)位列第一。
关键词
引用
@article{arxiv.2507.11764,
title = {AI Wizards at CheckThat! 2025: Enhancing Transformer-Based Embeddings with Sentiment for Subjectivity Detection in News Articles},
author = {Matteo Fasulo and Luca Babboni and Luca Tedeschini},
journal= {arXiv preprint arXiv:2507.11764},
year = {2025}
}
备注
14 pages, 6 figures, accepted at CLEF 2025 CheckThat! Lab