图灵测试:AI 聊天机器人在行为上是否与人类相似?
人工智能
2024-01-02 v2
摘要
我们对 AI 聊天机器人实施图灵测试。我们考察聊天机器人在一套旨在揭示信任、公平、风险规避、合作等特征的经典行为博弈中的表现,以及它们在用于衡量人格特质的传统 Big-5 心理调查中的反应。ChatGPT-4 表现出与来自 50 多个国家的数万名人类受试者中随机抽取的某个人在统计上无法区分的行为和人格特征。聊天机器人还会根据先前经验和情境"仿佛"从交互中学习般地调整自身行为,并针对同一策略情境的不同框架改变其行为。它们的行为常常区别于人类的平均和众数行为,在这种情况下,它们倾向于分布在更为利他和合作的一端。我们估计它们的行为仿佛在最大化自身与对方收益的平均值。
引用
@article{arxiv.2312.00798,
title = {A Turing Test: Are AI Chatbots Behaviorally Similar to Humans?},
author = {Qiaozhu Mei and Yutong Xie and Walter Yuan and Matthew O. Jackson},
journal= {arXiv preprint arXiv:2312.00798},
year = {2024}
}