从稳态到资源共享:基于多目标多智能体网格世界的生物学与经济学一致性AI安全基准
多智能体系统
2025-12-01 v5 人工智能
摘要
开发安全、一致性的智能体AI系统需要全面的经验测试,但许多现有基准忽略了与生物学和经济学相吻合的关键主题——这两种是描述我们需求与偏好的、经时间检验的基本科学。为弥合这一差距,本文聚焦于引入生物学和经济学动机的主题,这些主题在当前关于AI安全的主流讨论中被忽略——即强调对有界且生物学目标稳态、对无界、工具性和商业目标的递减报酬、可持续性原则以及资源共享的多目标、多智能体对齐基准。已实现八个主要基准环境,以上主题为基础,旨在说明智能体AI中的关键陷阱与挑战,如无限放大稳态目标、以牺牲其他目标为代价过度优化单个目标、忽视安全约束或耗尽共享资源。
引用
@article{arxiv.2410.00081,
title = {From homeostasis to resource sharing: Biologically and economically aligned multi-objective multi-agent gridworld-based AI safety benchmarks},
author = {Roland Pihlakas},
journal= {arXiv preprint arXiv:2410.00081},
year = {2025}
}
备注
21 pages, 13 figures, 2 tables