中文

黑盒部署下——面向LLM时代的人工道德代理功能准则

人工智能 2025-07-29 v2

摘要

强大且不可见的大型语言模型(LLM)的发展,迫切需要修订用于评估人工道德代理(AMA)的哲学准则。早期的LLM框架往往依赖透明架构的假设,而LLM因其随机输出和不可见的内部状态而违背这一假设。本文认为,由于这种匹配性的差异,传统的伦理准则在LLM方面已显得实用主义地过时。本文聚焦于技术哲学的核心议题,提出一套修订后的十项功能准则来评估基于LLM的人工道德代理:道德一致性、情境敏感性、规范完整性、元伦理意识、系统韧性、可信度、可纠正性、部分透明度、功能自主性和道德想象力。这些指南针针对我们所称的"SMA-LLS"(通过大型语言系统模拟道德代理)旨在引导AMA更好地实现对齐并实现有益的社会整合。我们通过涉及自主公共巴士(APB)的假设情景来说明这些准则在道德关键情境中的实际适用性。

关键词

引用

@article{arxiv.2507.13175,
  title  = {Black Box Deployed -- Functional Criteria for Artificial Moral Agents in the LLM Era},
  author = {Matthew E. Brophy},
  journal= {arXiv preprint arXiv:2507.13175},
  year   = {2025}
}

备注

42 pages. Supplementary material included at end of article