通过基督教对人类繁荣的理解评估人工智能
人工智能
2026-04-07 v1
摘要
人工智能对齐从根本上说是一个塑造问题,而不仅仅是一个安全问题。随着大型语言模型日益介入道德审议和灵性探究,它们所做的不仅仅是提供信息;它们充当了数字教化的工具,积极地塑造和规整人类的理解、决策和道德反思。为了使这种塑造性影响变得可见和可衡量,我们引入了“繁荣人工智能基准:基督教单轮对话”,这是一个旨在根据基督教对人类繁荣的理解,在七个维度上评估前沿模型响应的框架。通过将20个前沿模型与多元化和基督教特定标准进行比较,我们表明当前的人工智能系统并非世界观中立。相反,它们默认采用一种程序性世俗主义,缺乏维持神学连贯性所需的根基,导致在所有繁荣维度上系统性地表现下降约17分。最关键的是,在信仰与灵性维度上下降了31分。这些发现表明,价值观对齐方面的表现差距并非技术限制,而是源于优先考虑广泛可接受性和安全性而非深度、内部连贯的道德或神学推理的训练目标。
引用
@article{arxiv.2604.03356,
title = {Evaluating Artificial Intelligence Through a Christian Understanding of Human Flourishing},
author = {Nicholas Skytland and Lauren Parsons and Alicia Llewellyn and Steele Billings and Peter Larson and John Anderson and Sean Boisen and Steve Runge},
journal= {arXiv preprint arXiv:2604.03356},
year = {2026}
}