中文

论 AI 开放性:善意会被滥用吗?

计算与语言 2025-01-08 v2

摘要

开源是科学进步的驱动力。然而,这种开放性也是一把双刃剑,其内在风险在于创新技术可能被滥用于对社会有害的目的。开源 AI 模型或数据集被用于实施现实世界犯罪的可能性有多大?如果犯罪分子确实利用了它,技术背后的人是否能够逃脱法律责任?为了解决这些问题,我们探索了个人选择可能对社会产生重大影响的法律领域。具体而言,我们首先基于 200 份韩国判例构建了 EVE-V1 数据集,包含 200 对与刑事犯罪相关的问答对,以探索恶意模型出现的可能性。我们进一步使用 600 份与欺诈相关的判例开发了 EVE-V2,以确认存在能够就广泛犯罪主题提供有害建议的恶意模型,从而测试其域泛化能力。值得注意的是,广泛使用的开源大规模语言模型 (LLM) 在使用 EVE 进行微调后,会提供关于犯罪活动的不道德且详细的信息。我们还深入探讨了恶意语言模型及其构建者在现实中可能面临的法律问题。我们的发现凸显了一个悖论困境:开源加速了科学进步,但需要极其谨慎以最大程度地减少被滥用的可能性。警告:本文包含一些可能被认为是不道德的内容。

关键词

引用

@article{arxiv.2403.06537,
  title  = {On the Consideration of AI Openness: Can Good Intent Be Abused?},
  author = {Yeeun Kim and Hyunseo Shin and Eunkyung Choi and Hongseok Oh and Hyunjun Kim and Wonseok Hwang},
  journal= {arXiv preprint arXiv:2403.06537},
  year   = {2025}
}

备注

Accepted to AAAI 2025