中文

提升对价值与规范估计的置信度

人工智能 2021-05-17 v1 多智能体系统

摘要

自主智能体(AA)将日益频繁地参与我们的日常生活。尽管我们希望获得自主智能体带来的益处,但其行为必须与我们的价值与规范相一致,这一点至关重要。因此,自主智能体需要估计其所交互人类的价值观与规范,而在仅观察智能体行为时,这并非一项直截了当的任务。本文分析了自主智能体能在多大程度上基于模拟人类智能体(SHA)在最后通牒博弈中的行动来估计其价值与规范。我们提出两种方法来减少刻画SHA画像时的歧义:一种基于搜索空间探索,另一种基于反事实分析。我们发现两种方法均能提升估计人类价值与规范的置信度,但在适用性上有所不同,后者在需最小化与智能体交互次数时更为高效。这些洞见有助于改善自主智能体与人类价值及规范的契合。

关键词

引用

@article{arxiv.2004.01056,
  title  = {Improving Confidence in the Estimation of Values and Norms},
  author = {Luciano Cavalcante Siebert and Rijk Mercuur and Virginia Dignum and Jeroen van den Hoven and Catholijn Jonker},
  journal= {arXiv preprint arXiv:2004.01056},
  year   = {2021}
}

备注

16 pages, 3 figures, pre-print for the International Workshop on Coordination, Organizations, Institutions, Norms and Ethics for Governance of Multi-Agent Systems (COINE), co-located with AAMAS 2020