中文

面向 AI 安全的拜占庭容错方法

分布式、并行与集群计算 2026-04-30 v1

摘要

确保 AI 系统在面临意外故障或对抗性条件时能够可靠地按预期行为,是一项复杂挑战。本文受分布式计算中拜占庭容错(Byzantine Fault Tolerance, BFT)领域的启发,探讨了一种面向 AI 安全的容错架构。通过将不可靠、腐败、行为不当或恶意的 AI 实体类比为分布式系统中的拜占庭节点,我们提出了一种利用共识机制来提升 AI 安全性和可靠性的架构。

关键词

引用

@article{arxiv.2504.14668,
  title  = {A Byzantine Fault Tolerance Approach towards AI Safety},
  author = {John deVadoss and Matthias Artzt},
  journal= {arXiv preprint arXiv:2504.14668},
  year   = {2026}
}

备注

14 pages