中文

基于强化学习的分离过程合成

机器学习 2022-11-09 v1 计算工程、金融与科学

摘要

本文展示了在商业流程模拟软件(Aspen Plus V12)中实现强化学习(RL)以设计和优化精馏序列。SAC智能体的目标是通过利用精馏将烃类混合物分离为其各个组分,同时试图最大化该精馏序列所产生的利润。智能体的所有动作均由Python中的SAC智能体设定,并通过API在Aspen Plus中进行通信。此处精馏塔使用内置的RADFRAC塔进行模拟。由此建立了Python与Aspen之间的数据传输连接,且智能体在学习行为上取得成功,同时利润不断增加。尽管生成了结果,但Aspen的使用速度较慢(190小时),且发现Aspen不适合并行化。这使得Aspen不适用于求解RL问题。代码与论文可在 https://github.com/lollcat/Aspen-RL 获取。

关键词

引用

@article{arxiv.2211.04327,
  title  = {Synthesis of separation processes with reinforcement learning},
  author = {Stephan C. P. A. van Kalmthout and Laurence I. Midgley and Meik B. Franke},
  journal= {arXiv preprint arXiv:2211.04327},
  year   = {2022}
}