面向 AI 安全的拜占庭容错方法
分布式、并行与集群计算
2026-04-30 v1
摘要
确保 AI 系统在面临意外故障或对抗性条件时能够可靠地按预期行为,是一项复杂挑战。本文受分布式计算中拜占庭容错(Byzantine Fault Tolerance, BFT)领域的启发,探讨了一种面向 AI 安全的容错架构。通过将不可靠、腐败、行为不当或恶意的 AI 实体类比为分布式系统中的拜占庭节点,我们提出了一种利用共识机制来提升 AI 安全性和可靠性的架构。
引用
@article{arxiv.2504.14668,
title = {A Byzantine Fault Tolerance Approach towards AI Safety},
author = {John deVadoss and Matthias Artzt},
journal= {arXiv preprint arXiv:2504.14668},
year = {2026}
}
备注
14 pages