下一章:大语言模型在故事生成中的研究
计算与语言
2023-07-25 v3
摘要
为提升生成故事的质量,近期的故事生成模型一直在探究利用情节或常识知识等更高层次属性。以 GPT-3 为代表的大语言模型(LLMs)基于提示的学习在自然语言处理(NLP)的多种任务中展现出卓越性能。本文利用自动与人工评估,全面比较了 LLMs 与近期模型在三个风格、语域和故事长度各异的数据集上的故事生成能力。结果表明,LLMs 生成的故事质量显著高于其他故事生成模型。此外,它们展现出可与人类作者竞争的性能水平,尽管初步观察到在涉及世界知识的情况下它们倾向于复制真实故事,类似于一种剽窃形式。
引用
@article{arxiv.2301.09790,
title = {The Next Chapter: A Study of Large Language Models in Storytelling},
author = {Zhuohan Xie and Trevor Cohn and Jey Han Lau},
journal= {arXiv preprint arXiv:2301.09790},
year = {2023}
}
备注
Accepted to INLG2023