人类-人工智能协作的无免费定理
人工智能
2024-11-26 v1 人机交互
机器学习
摘要
人类-人工智能协作的金标准是互补性——即组合后的性能超过单独的人类或算法。我们在二分类设置中检验这一挑战,即目标是最大化 0-1 准确率。给定两个或多个能够作出已校准概率预测的代理人,我们展示了一个类似“无免费定理”的结果。任何确定性协作策略(将已校准概率映射为二元分类的函数)如果不本质上总是退让给同一代理人,便有时会表现得比最不准确的代理人更差。换言之,互补性并非“免费”。该结果指示一种具有保证的协作模型,即一个代理人识别另一个代理人的“显而易见”错误。我们还利用该结果理解其他协作技术成功所需的条件,为人类-人工智能协作提供指导。
引用
@article{arxiv.2411.15230,
title = {A No Free Lunch Theorem for Human-AI Collaboration},
author = {Kenny Peng and Nikhil Garg and Jon Kleinberg},
journal= {arXiv preprint arXiv:2411.15230},
year = {2024}
}