单靠创作是不够的:评估LLM与人类在幽默创作中的协同创作
人机交互
2025-01-24 v2
摘要
合作被证明可提升创造力,产生更具创新性和效果的成果。虽然已有研究探索了大型语言模型(LLM)作为创作伙伴在诗歌创作或叙事创作等任务中的能力,但LLM在幽默丰富且文化包容性强的领域中的协同潜力仍是未知之谜。为填补这一空白,我们开展了用户研究,探讨LLM在共同创作memes——一种幽默驱动且文化特定的创造性表达形式中的潜力。我们组织了由50名参与者组成的三个实验组:人类独立创作memes(无AI辅助)、人类-AI协作组(与最先进的LLM模型交互)、AI独立组(LM自动生成memes)。我们通过众包方式评估所生成memes的质量,分别对其创意性、幽默性和传播性进行评分。结果显示,LLM辅助显著增加了所获想法的数量,降低了参与者的主观 effort,但未提升人类与LLM协作memes的质量。有趣的是,完全由AI生成的memes在所有指标上平均均优于人类独立和人类-AI协作生成的memes。然而,若聚焦表现最优的memes,人类创作的memes在幽默性方面表现更佳,而人类-AI协作则在创意性和传播性方面脱颖而出。这些发现凸显了人类-AI协作在创意任务中的复杂性:尽管AI可提升生产力并创造面向大众的内容,但人类的创造力仍是实现内容在深层次上产生共鸣的关键。
引用
@article{arxiv.2501.11433,
title = {One Does Not Simply Meme Alone: Evaluating Co-Creativity Between LLMs and Humans in the Generation of Humor},
author = {Zhikun Wu and Thomas Weber and Florian Müller},
journal= {arXiv preprint arXiv:2501.11433},
year = {2025}
}
备注
to appear in: 30th International Conference on Intelligent User Interfaces IUI 25 March 2427 2025 Cagliari Italy