智能体间信任模型:Agentic Web协议设计中简述、声明、证明、质押、声誉与约束的比较研究——A2A、AP2、ERC-8004及未来
人机交互
2025-11-06 v1 人工智能
多智能体系统
网络与互联网体系结构
社会与信息网络
摘要
随着“Agentic Web”的成形——数十亿AI智能体(通常由大语言模型驱动)自主进行交易与协作——信任从人类监督转向协议设计。2025年,几种智能体间协议明确了这一转变,包括Google的Agent-to-Agent (A2A)、Agent Payments Protocol (AP2)和以太坊的ERC-8004“Trustless Agents”,然而它们底层的信任假设仍未得到充分审视。本文对智能体间协议设计中的信任模型进行了比较研究:简述(自我或第三方可验证声明)、声明(自我宣称的能力和身份,例如AgentCard)、证明(密码学验证,包括零知识证明和可信执行环境认证)、质押(附带罚没和保险的抵押品)、声誉(群体反馈和基于图的信任信号)以及约束(沙箱化和能力边界限定)。针对每种模型,我们分析了其假设、攻击面和设计权衡,特别强调了LLM特有的脆弱性——提示注入、谄媚/易受诱导、幻觉、欺骗和不对齐——这些使得纯声誉或纯声明的方法变得脆弱。我们的发现表明,没有单一机制是足够的。我们主张以“默认无信任”架构为基础,该架构植根于证明和质押以控制高影响行为,辅以简述用于身份和发现,以及声誉层用于灵活性和社会信号。我们在涵盖安全性、隐私性、延迟/成本和社会鲁棒性(抗女巫攻击/合谋/洗白)的指标下,比较评估了A2A、AP2、ERC-8004及相关学术研究中的历史变体。最后,我们提出了混合信任模型建议,以减轻声誉博弈和误导性的LLM行为,并提炼出更安全、可互操作和可扩展的智能体经济的可行设计指南。
引用
@article{arxiv.2511.03434,
title = {Inter-Agent Trust Models: A Comparative Study of Brief, Claim, Proof, Stake, Reputation and Constraint in Agentic Web Protocol Design-A2A, AP2, ERC-8004, and Beyond},
author = {Botao 'Amber' Hu and Helena Rong},
journal= {arXiv preprint arXiv:2511.03434},
year = {2025}
}
备注
Submitted to AAAI 2026 Workshop on Trust and Control in Agentic AI (TrustAgent)