中文

奖惩对称普适智能

人工智能 2021-10-07 v1

摘要

一个智能体的智能水平可以为负吗?我们扩展了 Legg-Hutter 智能体-环境框架以纳入惩罚,并论证了该问题的肯定答案。我们表明,若背景编码与通用图灵机(UTM)承认某些 Kolmogorov 复杂度对称性,则由此得到的 Legg-Hutter 智能度量关于原点对称。特别地,这意味着在此类 UTM 下,忽略奖励的智能体具有 Legg-Hutter 智能 0。

关键词

引用

@article{arxiv.2110.02450,
  title  = {Reward-Punishment Symmetric Universal Intelligence},
  author = {Samuel Allen Alexander and Marcus Hutter},
  journal= {arXiv preprint arXiv:2110.02450},
  year   = {2021}
}

备注

11 pages, accepted to AGI-21