应用TD3训练神经网络穿越FPV门的四旋翼飞行器
机器人学
2024-12-20 v1 机器学习
摘要
深度强化学习已被证明是在最优解不明确的环境中制定策略的强大工具。在本文中,我们尝试应用双延迟深度确定性策略梯度(TD3)训练神经网络作为四旋翼飞行器的速度控制器。四旋翼飞行器的目标是快速穿越门同时避免撞到门。我们将训练好的策略通过部署在实验室环境中的四旋翼飞行器上迁移到现实世界。最后,我们证明训练好的策略能够在现实世界中引导无人机到达门。
引用
@article{arxiv.2412.14367,
title = {Implementing TD3 to train a Neural Network to fly a Quadcopter through an FPV Gate},
author = {Patrick Thomas and Kevin Schroeder and Jonathan Black},
journal= {arXiv preprint arXiv:2412.14367},
year = {2024}
}