受单边约束机械系统中的非光滑最优值函数与策略函数
机器人学
2019-08-29 v2
摘要
最优控制的先进方法使用值函数与策略函数的平滑近似,以及基于梯度的算法来改进近似器参数。遗憾的是,我们证明,在受单边约束(即机器人运动与操作的富接触动力学)的机械系统最优控制中出现的值函数与策略函数通常是非光滑的,因为底层动力学表现出不连续或分段可微的轨迹结果。简单机械系统被用来阐明这一结果及其对富接触机器人动力学最优控制的影响。
引用
@article{arxiv.1710.06745,
title = {Nonsmooth optimal value and policy functions in mechanical systems subject to unilateral constraints},
author = {Bora S. Banjanin and Samuel A. Burden},
journal= {arXiv preprint arXiv:1710.06745},
year = {2019}
}
备注
Submitted to IEEE CSL