中文

(何时)真相陈述在 AI 辩论中占优?

人工智能 2021-03-17 v3 计算机科学与博弈论

摘要

对于某些问题,人类可能无法准确判断 AI 提出的解决方案的优劣。Irving 等人(2018)提出,在此类情况下,我们可以使用两个 AI 系统之间的辩论来放大人类裁判的问题解决能力。我们引入了一个可以对此类辩论建模的数学框架,并建议辩论设计的质量应由最具说服力答案的准确度来衡量。我们描述了辩论框架的一个简单实例,称为特征辩论,并分析了此类辩论在多大程度上追踪真相。我们认为,尽管非常简单,特征辩论仍捕捉了实际辩论的许多方面,例如混淆裁判或拖延以防止失败的动机。然后我们概述了应如何推广这些模型,以分析更广泛的辩论现象。

关键词

引用

@article{arxiv.1911.04266,
  title  = {(When) Is Truth-telling Favored in AI Debate?},
  author = {Vojtěch Kovařík and Ryan Carey},
  journal= {arXiv preprint arXiv:1911.04266},
  year   = {2021}
}

备注

In SafeAI Workshop at AAAI, 2019