中文

智能体行为:AI 数字时代中的模型、治理与挑战

人工智能 2025-08-21 v1

摘要

人工智能的进步使得网络环境中的智能体越来越能模仿人类行为,从而在特定情境下模糊了人工行为体与人类行为体之间的界限。这种转变带来了信任、责任、伦理、安全等方面的重大挑战。对智能体行为监督的困难可能导致数据污染和责任不清等问题。为了应对这些挑战,本文提出了“网络行为生命周期”模型,该模型将网络行为分为 6 个阶段,并系统地分析了每个阶段人类与智能体之间的行为差异。基于这些见解,本文进一步引入了“智能体对智能体 (A4A)”范式和“人机行为差异 (HABD)”模型,从决策机制、执行效率、意图-行为一致性、行为惯性和非理性模式这 5 个维度审视人类与智能体行为的根本区别。通过红队渗透和蓝队防御等真实案例验证了该模型的有效性。最后,本文讨论了动态认知治理架构、行为差异量化和元治理协议栈等未来研究方向,旨在为安全可信的人机协作提供理论基础和技术路线图。

关键词

引用

@article{arxiv.2508.14415,
  title  = {The Agent Behavior: Model, Governance and Challenges in the AI Digital Age},
  author = {Qiang Zhang and Pei Yan and Yijia Xu and Chuanpo Fu and Yong Fang and Yang Liu},
  journal= {arXiv preprint arXiv:2508.14415},
  year   = {2025}
}