中文

鲁棒的 AI 安全与对齐:一项西西弗斯式的努力?

人工智能 2026-05-18 v2

摘要

本文通过将哥德尔不完备定理扩展至 AI,确立了 AI 安全与对齐鲁棒性的信息论局限。了解这些局限并为其带来的挑战做好准备,对于负责任地采用 AI 技术至关重要。本文还提供了应对这些挑战的实用方法。此外,还证明了对 AI 系统认知推理局限性的更广泛影响。

关键词

引用

@article{arxiv.2512.10100,
  title  = {Robust AI Security and Alignment: A Sisyphean Endeavor?},
  author = {Apostol Vassilev},
  journal= {arXiv preprint arXiv:2512.10100},
  year   = {2026}
}

备注

17 pages, 1 figure. This version will appear in IEEE Security $ Privacy in June 2026