快慢决策的穿插
人工智能
2021-10-26 v2
摘要
Kahneman 的“思考,快与慢”范式提出我们使用两种不同风格的思维——用于特定任务的快速直觉式系统 1,以及用于其他任务的较慢但更具分析性的系统 2。虽然这种双系统思维风格在 AI 与机器人学中日益流行,我们的工作考虑如何穿插两种决策风格,即系统 1 与系统 2 应如何协同使用。为此,我们提出一个新颖且通用的框架,其中包含一个新的系统 0 来监督系统 1 与系统 2。在每次需要决策时,系统 0 评估情境并迅速将决策过程交给系统 1 或系统 2。我们在修改版经典吃豆人游戏上评估该框架,其中系统 1 采用已训练的 RL 算法,系统 2 采用蒙特卡洛树搜索,系统 0 采用若干不同可能策略。正如预期,系统 1 与系统 2 间的任意切换无效,但某些策略表现良好。借助系统 0,智能体能够比仅用系统 1 或系统 2 的智能体表现更优。
引用
@article{arxiv.2010.16244,
title = {Interleaving Fast and Slow Decision Making},
author = {Aditya Gulati and Sarthak Soni and Shrisha Rao},
journal= {arXiv preprint arXiv:2010.16244},
year = {2021}
}
备注
7 pages, 11 figures; typos corrected, references added