ML-Promise: 用于企业承诺验证的多语言数据集
计算与语言
2024-11-08 v1
摘要
政治家、企业领袖和公众人物做出的承诺对公众认知、信任和机构声誉具有重大影响。然而,此类承诺的复杂性和数量庞大,加之验证其履行的困难,需要创新方法来评估其可信度。本文提出了承诺验证的概念,一种系统化方法,包括承诺识别、证据评估和验证时机评估等步骤。我们提出了首个多语言数据集 ML-Promise,涵盖英语、法语、中文、日语和韩语,旨在促进对承诺的深入验证,特别是在环境、社会和治理(ESG)报告的背景下。鉴于对企业环境贡献的日益重视,该数据集解决了评估企业承诺的挑战,尤其是面对漂绿等行为。我们的研究还探索了基于文本和图像的基线方法,检索增强生成(RAG)方法取得了有前景的结果。本研究旨在促进跨多种语言和领域对公共承诺问责性的进一步讨论。
引用
@article{arxiv.2411.04473,
title = {ML-Promise: A Multilingual Dataset for Corporate Promise Verification},
author = {Yohei Seki and Hakusen Shu and Anaïs Lhuissier and Hanwool Lee and Juyeon Kang and Min-Yuh Day and Chung-Chi Chen},
journal= {arXiv preprint arXiv:2411.04473},
year = {2024}
}
备注
6 pages