中文

评估企业内 LLM 对齐策略

计算机与社会 2025-05-27 v1

摘要

指令调优大型语言模型(LLM)日益被部署为企业中的 AI Assistant,以支持认知任务。这些 AI Assistant 携带内嵌的观点,这些观点影响企业内部的诸多因素,包括决策、协作和组织文化。这篇论文认为,企业必须有意识地将这些 AI Assistant 的观点与其目标和价值观对齐,将对齐描绘为维持企业文化和内部道德规范控制的关键战略和伦理责任。论文概述了 AI 观点如何源于训练数据中的偏见以及开发人员的微调目标,并讨论了其影响和伦理意义,突出了自动化偏见和减少批判性思维等伦理关切。drawing on 规范性商业伦理,特别是非还原主义的职业关系观点,提出了三种不同的对齐策略:支持型(强化企业使命)、对抗型(检验想法)以及多样化(通过整合多个利益相关者视点来拓宽道德视野)。分析了每种策略的伦理权衡及其对经理-员工和员工-员工关系的影响,以及塑造企业文化和道德纤维的潜在影响。

关键词

引用

@article{arxiv.2505.18779,
  title  = {Evaluating Intra-firm LLM Alignment Strategies in Business Contexts},
  author = {Noah Broestl and Benjamin Lange and Cristina Voinea and Geoff Keeling and Rachael Lam},
  journal= {arXiv preprint arXiv:2505.18779},
  year   = {2025}
}

备注

9 pages, 0 figures