伦理引擎:用于可及性心理测量大语言模型的模块化管道
计算机与社会
2025-10-15 v1
摘要
随着大语言模型日益介入人类沟通与决策,理解其价值表达对跨学科研究至关重要。本文提出了伦理引擎(Ethics Engine),一个模块化的 Python 管道,将大语言模型的心理测量从技术复杂的任务转化为可及的研究工具。该管道展示了如何通过审慎的基础设施设计来扩大人工智能研究的参与度,使认知科学、政治心理学、教育等领域的研究者能够 study 语言模型中的价值表达。Edinburgh 大学的研究者采用该工具研究专制主义,验证了其研究实用性,处理了超过 1 万 条来自多款模型和多种情境下的 AI 回复。我们认为,此类工具通过降低技术门槛同时保持科学严谨,彻底改变了人工智能研究的格局。随着大语言模型日益成为认知基础设施,其内嵌价值塑造了数以百万计的日常互动。若不系统测量这些价值表达,我们部署的系统其道德影响仍是未被图谱化的。伦理引擎为监管这些有影响力技术提供了必要的严谨评估能力。
引用
@article{arxiv.2510.11742,
title = {The Ethics Engine: A Modular Pipeline for Accessible Psychometric Assessment of Large Language Models},
author = {Jake Van Clief and Constantine Kyritsopoulos},
journal= {arXiv preprint arXiv:2510.11742},
year = {2025}
}
备注
18 pages, 2 figures. Code available at https://github.com/RinDig/GPTmetrics