计划被惊喜:动态环境中的最优贝叶斯探索
人工智能
2011-03-30 v1 机器学习
摘要
为了最大化其成功率,AGI通常需要探索其最初未知的世界。是否存在一种最优的探索方式?在此,我们针对一大类环境得出了肯定的答案。
引用
@article{arxiv.1103.5708,
title = {Planning to Be Surprised: Optimal Bayesian Exploration in Dynamic Environments},
author = {Yi Sun and Faustino Gomez and Juergen Schmidhuber},
journal= {arXiv preprint arXiv:1103.5708},
year = {2011}
}