中文

葡萄牙语自然语言处理模型训练的法律框架

计算与语言 2024-05-02 v1 新兴技术

摘要

近期深度学习的进展推动了许多能够执行智能行为的计算系统的出现,这些行为直到此前都局限于人类智能。就人类语言而言,这些进展使得能够生成连贯文本的应用程序(如ChatGPT)得以出现,而这些应用程序并非通过明确编程即可实现。相反,这些模型使用大量文本数据来学习人类语言的有意义表征。伴随这些进展,关于这些应用程序导致版权和数据隐私侵权的担忧也随之出现。尽管存在这些担忧,但新的自然语言处理应用程序开发的速度仍显著快于新法规的引介。今天,由于法律专家与计算机科学家之间的沟通障碍,在开发此类应用程序时会导致许多意外的法律侵权行为。本文旨在搭建这种沟通障碍的桥梁,推动更符合葡萄牙语NLP研究的合规性,通过呈现一系列日常NLP用例并突出可能涉及的葡萄牙法律。

关键词

引用

@article{arxiv.2405.00536,
  title  = {A Legal Framework for Natural Language Processing Model Training in Portugal},
  author = {Rúben Almeida and Evelin Amorim},
  journal= {arXiv preprint arXiv:2405.00536},
  year   = {2024}
}

备注

LEGAL2024 Legal and Ethical Issues in Human Language Technologies, LREC 2024