中文

Puda:用于用户主权与隐私保护的私有用户数据代理

人工智能 2026-02-11 v2

摘要

主流平台提供商(包括搜索引擎、社交网络服务和电子商务)的数据集中化已导致构建封闭生态系统,这些生态系统限制了用户主权,从而阻碍了数据在服务之间的跨使用。同时,基于大型语言模型 (LLM) 的智能体的快速普及加剧了对高度个性化服务的需求,这些服务需要动态提供多样化的个人数据。这是一个显著的挑战:在利用此类数据与隐私保护之间取得平衡。为此,我们提出了 Puda (Private User Dataset Agent),一种实现用户主权的数据聚合架构,支持客户端管理。Puda 允许用户以三种隐私层级控制数据共享:(i) 详细浏览历史记录,(ii) 提取关键词,以及 (iii) 预定义类别子集。我们将 Puda 实现为基于浏览器的系统,作为跨服务的通用平台,并通过个性化旅行规划任务进行评估。我们的结果表明,以预定义类别子集提供的隐私保护,在三个评估标准上(由 LLM 作为评判员框架评估)可达到97.2%的个性化性能,当共享详细浏览历史记录时可获得更佳效果。这些发现表明,Puda 能够实现有效的多层次管理,为缓解隐私-个性化权衡提供了实际选择。总体而言,Puda 为用户主权提供了面向 AI 的基础设施,使用户能够安全地充分利用个性化 AI 的全部潜力。

关键词

引用

@article{arxiv.2602.08268,
  title  = {Puda: Private User Dataset Agent for User-Sovereign and Privacy-Preserving Personalized AI},
  author = {Akinori Maeda and Yuto Sekiya and Sota Sugimura and Tomoya Asai and Yu Tsuda and Kohei Ikeda and Hiroshi Fujii and Kohei Watanabe},
  journal= {arXiv preprint arXiv:2602.08268},
  year   = {2026}
}

备注

9 pages, 5 figures