一种用于设计强化学习智能体的低成本伦理塑造方法
人工智能
2018-09-11 v2
摘要
本文提出一种低成本、易实现的策略,使强化学习(RL)智能体具备符合伦理行事的能力。我们的模型允许RL智能体的设计者仅专注于待实现的任务,而无需担心实现多个需遵循的琐碎伦理模式。基于无论实现何种目标多数人类行为都是符合伦理的这一假设,我们的设计将人类策略与RL策略相整合,从而在较小违反人类通常遵守的伦理规范之可能下达成目标。
引用
@article{arxiv.1712.04172,
title = {A Low-Cost Ethics Shaping Approach for Designing Reinforcement Learning Agents},
author = {Yueh-Hua Wu and Shou-De Lin},
journal= {arXiv preprint arXiv:1712.04172},
year = {2018}
}
备注
AAAI 2018 Oral Presentation