有限披露下的分类验证
机器学习
2025-02-27 v1 密码学与安全
计算机与社会
数据结构与算法
摘要
我们考虑由 Dong、Hartline 和 Vijayaraghavan(2022)提出的多方分类问题,这一问题由电子发现驱动。我们的目标是设计一种协议,确保请求方获得 nearly all responsive 文档,同时最小化 nonresponsive 文档的披露。我们开发了验证协议,通过披露少量 nonresponsive 文档来证明分类器的正确性。我们引入一种称为分类器族 Leave-One-Out 维度的组合概念,表明本协议披露的 nonresponsive 文档数量最多为该维度,在可实现情形下,即存在该族中完美分类器时。对于具有边际的线性分类器,我们刻画了边际与必须披露的 nonresponsive 文档数量之间的权衡。具体而言,我们建立了一个三分论:对于 d 维实例,当边际超过 1/3 时,通过揭示仅 个 nonresponsive 文档即可实现验证;当边际恰为 1/3 时,在最坏情况下,至少需要披露 个 nonresponsive 文档;当边际小于 1/3 时,验证需要披露 个 nonresponsive 文档。我们认为此结果在独立意义上具有应用,包括编码理论和组合几何。我们进一步将协议扩展至不可实现情形,定义类似的组合量 robust Leave-One-Out 维度,并针对 Alice 容忍误分类错误的情形。
关键词
引用
@article{arxiv.2502.16352,
title = {Verifying Classification with Limited Disclosure},
author = {Siddharth Bhandari and Liren Shan},
journal= {arXiv preprint arXiv:2502.16352},
year = {2025}
}
备注
18 pages, 0 figures