中文

模型卡与数据卡的自动生成:迈向负责任AI的一步

计算与语言 2024-06-21 v2

摘要

在机器学习/人工智能领域模型与数据激增的时代,尤其是开源技术的快速发展,对标准化、一致性文档的需求变得至关重要。我们的工作解决了当前人工生成的模型卡和数据卡中存在的信息不完整问题。我们提出了一种使用大语言模型(LLMs)的自动生成方法。我们的主要贡献包括建立了CardBench,一个由超过4.8k张模型卡和1.4k张数据卡聚合而成的综合数据集,以及开发了包含两步检索过程的CardGen流水线。我们的方法在生成的模型卡和数据卡中展现出更高的完整性、客观性和忠实度,这是在负责任的AI文档实践中迈出的重要一步,确保了更好的可问责性和可追溯性。

关键词

引用

@article{arxiv.2405.06258,
  title  = {Automatic Generation of Model and Data Cards: A Step Towards Responsible AI},
  author = {Jiarui Liu and Wenkai Li and Zhijing Jin and Mona Diab},
  journal= {arXiv preprint arXiv:2405.06258},
  year   = {2024}
}

备注

NAACL 2024 (Oral)