协调博弈中概率短语的使用:人类与 GPT-4 的比较
神经元与认知
2023-11-28 v3 人工智能
摘要
英语使用者使用诸如“likely”之类的概率短语来传达关于事件概率或可能性的信息。当听者领会说话者意图传达的内容时,交流便是成功的;若交流成功,个体便可基于关于不确定性的共享知识来协调其行动。我们首先在两种不同情境(投资建议和医疗建议)下的协调博弈中,评估人类估计二十三个概率短语的概率与模糊性(不精确性)的能力。随后,我们让大型语言模型 GPT4(OpenAI)完成与人类参与者相同的任务。我们发现,中位数人类参与者与 GPT4 所赋予的概率估计具有良好的一致性(解释方差比例接近 0.90)。在投资和医疗情境中,GPT4 的概率估计与人类参与者的估计之间的接近程度,等同于或优于人类参与者彼此估计之间的接近程度。人类参与者和 GPT4 的概率估计均几乎不受情境影响。相比之下,人类与 GPT4 的模糊性估计并未达成如此良好的一致。
引用
@article{arxiv.2310.10544,
title = {Use of probabilistic phrases in a coordination game: human versus GPT-4},
author = {Laurence T Maloney and Maria F Dal Martello and Vivian Fei and Valerie Ma},
journal= {arXiv preprint arXiv:2310.10544},
year = {2023}
}
备注
Corrected typos, extended discussion, added references