“你被拒绝了!”:大语言模型就业评估的实证研究
计算与语言
2025-10-24 v2
摘要
随着互联网的普及和人工智能的快速发展,领先的技术公司面临着对大量软件和算法工程师的紧迫年度需求。为高效识别来自数千名申请人中潜力巨大的候选人,这些公司建立了包括多阶段筛选过程在内的标准化招聘流程,这一流程关键包括旨在评估特定职位能力的标准化招聘评估。针对大语言模型 (LLM) 在编码和推理任务中显示出的卓越表现,本文调查了一个关键问题:大语言模型能否通过这些招聘评估?为此,我们对广泛使用的专业评估问卷进行了全面检查。我们采用最先进的大语言模型生成响应并随后对其性能进行评估。与任何 LLM 成为理想工程师的先前期望相反,我们的分析揭示了模型生成答案与公司参考解决方案之间的显著不一致。我们的实证发现导致一个惊人结论:所有评估的大语言模型均未通过招聘评估。
引用
@article{arxiv.2510.19167,
title = {"You Are Rejected!": An Empirical Study of Large Language Models Taking Hiring Evaluations},
author = {Dingjie Fu and Dianxing Shi},
journal= {arXiv preprint arXiv:2510.19167},
year = {2025}
}
备注
Technical Report, 14 pages, 8 figures