AiiDA 1.0:面向自动化可复现工作流与数据溯源的可扩展计算基础设施
分布式、并行与集群计算
2020-12-08 v1 材料科学
摘要
计算能力的日益增长与先进计算方法的持续发展极大地促进了近期的科学进步。这些发展带来了由海量待管理的计算与数据所驱动的新挑战。下一代 exascale 超级计算机将加剧这些挑战,使得自动化且可扩展的解决方案变得至关重要。近年来,我们一直开发 AiiDA (http://www.aiida.net),这是一个稳健的开源高通量基础设施,旨在应对自动化工作流管理与数据溯源记录需求所带来的挑战。在此,我们介绍为达到持续性能所需的开发与能力,AiiDA 支持每小时数万进程的通量,同时在关系型数据库中自动保存并存储完整的数据溯源,使其可查询与遍历,从而实现高性能数据分析。AiiDA 的工作流语言提供高级自动化、错误处理特性以及灵活的插件模型,以允许与任何仿真软件对接。相关的插件注册表实现了扩展的无缝共享,赋能一个充满活力的用户社区,致力于使仿真更稳健、更用户友好且可复现。
引用
@article{arxiv.2003.12476,
title = {AiiDA 1.0, a scalable computational infrastructure for automated reproducible workflows and data provenance},
author = {Sebastiaan. P. Huber and Spyros Zoupanos and Martin Uhrin and Leopold Talirz and Leonid Kahle and Rico Häuselmann and Dominik Gresch and Tiziano Müller and Aliaksandr V. Yakutovich and Casper W. Andersen and Francisco F. Ramirez and Carl S. Adorf and Fernando Gargiulo and Snehal Kumbhar and Elsa Passaro and Conrad Johnston and Andrius Merkys and Andrea Cepellotti and Nicolas Mounet and Nicola Marzari and Boris Kozinsky and Giovanni Pizzi},
journal= {arXiv preprint arXiv:2003.12476},
year = {2020}
}