R-HTN:面向安全性与游戏 AI 的反叛式在线 HTN 规划
人工智能
2026-02-03 v1
摘要
我们提出一种在线层次任务网络(HTN)代理,其行为由一组内置指令 \D 控制。像其他具有反叛能力(即" intelligent disobedience")的代理一样,我们的代理将在某些条件下,不执行用户分配的任务,而是以不符合用户期望的方式行动。我们的工作结合了三种概念:HTN 规划、在线规划和指令 \D,这些指令在执行用户分配的任务时必须被考虑。我们检验了两种代理变体:(1)一种非自适应代理,如果发现自己违反 \D 则停止执行;(2)一种自适应代理,在相同情况下,改为修改其 HTN 计划以搜索实现给定任务的替代方式。我们提出R-HTN(即 Rebellious-HTN),这是一种用于在指令 \D 下的在线 HTN 规划的通用算法。我们在两个任务域中评估了R-HTN,在这些域中,代理必须避免违反某些指令以获得安全,或根据其人格特征遵守指令。我们发现,R-HTN 代理从不违反指令,旨在可行情况下实现用户给定的目标,尽管并非如用户所期望。
引用
@article{arxiv.2602.00951,
title = {R-HTN: Rebellious Online HTN Planning for Safety and Game AI},
author = {Hector Munoz-Avila and David W. Aha and Paola Rizzo},
journal= {arXiv preprint arXiv:2602.00951},
year = {2026}
}