洛韦莱斯智力测试:人类能否识别和评价AI生成的艺术作品?
计算机与社会
2025-09-16 v1
摘要
本研究旨在通过艺术创造力评估机器智能,采用受女王洛韦斯启发的图灵测试改进版本。其研究假设包括:人类评判员能否可靠地区分AI生成的艺术品与人类创作的作品,以及AI生成的艺术品是否与人类创作的作品在审美价值上相媲美。该研究旨在深化对机器创造力及其对认知科学和AI技术影响的理解。参与者均具有认知科学和计算机科学等领域的教育背景,担任质询员身份,评估一组绘画是AI生成还是人类创作。我们采用并行配对和口述两种版本的图灵测试。此外,还收集了审美评估数据,以比较AI生成图像与人类创作艺术品的感知质量。在这种双方法方法下,我们得出以下结论:在某些测试条件下,参与者难以可靠地区分AI生成和人类创作的艺术品,表现不如随机猜测。此外,AI生成的艺术品被评定为与人类创作作品相当的审美价值。我们的发现挑战了关于人类创造力的传统假设,表明AI系统能够生成与人类感受共鸣的输出,同时满足创造智能的标准。本研究通过结合图灵测试和洛韦斯测试的元素,推进了对机器创造力的理解。不同于以往仅关注普通人群或艺术家的研究,本研究聚焦具有专业背景的参与者,同时提供了两种不同测试方法(并行配对与口述)的比较分析,为评估机器智能提供了新视角。
引用
@article{arxiv.2509.11371,
title = {The Lovelace Test of Intelligence: Can Humans Recognise and Esteem AI-Generated Art?},
author = {Ewelina Gajewska},
journal= {arXiv preprint arXiv:2509.11371},
year = {2025}
}