从挣扎(06-2024)到掌握(02-2025):LLM 征服高级算法考试并为编辑生成铺路
计算与语言
2025-06-06 v1 人工智能
摘要
本文对最新时代大型语言模型(LLM)在挑战性大学水平算法考试中的表现进行全面评估。通过在罗马尼亚考试及其高质量英语翻译上测试多个模型,我们分析了 LLM 的 problem-solving 能力、一致性和多语言性能。我们的实证研究表明,最新模型不仅实现了与顶尖学生相当的得分,还在复杂的多步骤算法挑战中展现出稳健的推理能力,尽管在图基任务方面仍存在困难。基于这些发现,我们探讨了 LLM 支持教育环境的潜力,通过生成高质量的编辑内容,为教师提供了一个强大的工具,以增强学生反馈。本文讨论的见解和最佳实践为进一步将生成式 AI 集成到高级算法教育领域奠定了基础。
引用
@article{arxiv.2506.04965,
title = {From Struggle (06-2024) to Mastery (02-2025) LLMs Conquer Advanced Algorithm Exams and Pave the Way for Editorial Generation},
author = {Adrian Marius Dumitran and Theodor-Pierre Moroianu and Vasile Paul Alexe},
journal= {arXiv preprint arXiv:2506.04965},
year = {2025}
}
备注
15 pages Pre-print Paper accepted to ITS 2025