奖惩对称普适智能
人工智能
2021-10-07 v1
摘要
一个智能体的智能水平可以为负吗?我们扩展了 Legg-Hutter 智能体-环境框架以纳入惩罚,并论证了该问题的肯定答案。我们表明,若背景编码与通用图灵机(UTM)承认某些 Kolmogorov 复杂度对称性,则由此得到的 Legg-Hutter 智能度量关于原点对称。特别地,这意味着在此类 UTM 下,忽略奖励的智能体具有 Legg-Hutter 智能 0。
引用
@article{arxiv.2110.02450,
title = {Reward-Punishment Symmetric Universal Intelligence},
author = {Samuel Allen Alexander and Marcus Hutter},
journal= {arXiv preprint arXiv:2110.02450},
year = {2021}
}
备注
11 pages, accepted to AGI-21