中文

机器的道德指南针:评估大型语言模型在建设项目管理中的决策支持能力

人工智能 2025-09-08 v1 计算机与社会

摘要

人工智能 (AI) 与建设项目管理 (CPM) 的整合正在加速,大型语言模型 (LLMs) 正逐渐成为易于使用的决策支持工具。本研究旨在批判性评估 LLMs 应用于 CPM 固有的伦理敏感、高风险决策情境时的伦理可行性与可靠性。研究采用了混合方法研究设计,包括使用新颖的伦理决策支持评估清单 (EDSAC) 对两个领先 LLM 在十二个真实伦理场景下的定量性能测试,以及对十二位行业专家的半结构化访谈进行定性分析,以捕捉专业认知。研究结果表明,尽管 LLMs 在法律合规等结构化领域表现出足够的性能,但在处理上下文细微差别、确保问责制和提供透明推理方面存在显著缺陷。利益相关者对将 AI 自主用于伦理判断表示了相当大的保留意见,强烈主张建立稳健的人机协同监督。据我们所知,这是首批在建筑领域实证测试 LLMs 伦理推理的研究之一。它引入了 EDSAC 框架作为可复现的方法论,并提供了可操作的建议,强调 LLMs 目前最适合作为决策支持辅助工具,而非自主的伦理代理。

关键词

引用

@article{arxiv.2509.04505,
  title  = {The Ethical Compass of the Machine: Evaluating Large Language Models for Decision Support in Construction Project Management},
  author = {Somtochukwu Azie and Yiping Meng},
  journal= {arXiv preprint arXiv:2509.04505},
  year   = {2025}
}

备注

16 Pages