鲁棒的 AI 安全与对齐:一项西西弗斯式的努力?
人工智能
2026-05-18 v2
摘要
本文通过将哥德尔不完备定理扩展至 AI,确立了 AI 安全与对齐鲁棒性的信息论局限。了解这些局限并为其带来的挑战做好准备,对于负责任地采用 AI 技术至关重要。本文还提供了应对这些挑战的实用方法。此外,还证明了对 AI 系统认知推理局限性的更广泛影响。
引用
@article{arxiv.2512.10100,
title = {Robust AI Security and Alignment: A Sisyphean Endeavor?},
author = {Apostol Vassilev},
journal= {arXiv preprint arXiv:2512.10100},
year = {2026}
}
备注
17 pages, 1 figure. This version will appear in IEEE Security $ Privacy in June 2026