下一代 CAPTCHA:利用认知差异实现可扩展且多样化的 GUI 智能体防御
机器学习
2026-02-10 v1 人工智能
计算与语言
摘要
GUI 化智能体的快速演进使传统 CAPTCHA 已过时。虽然 OpenCaptchaWorld 等先前基准为评估多模态智能体奠定了基线,但近期推出的推理型模型(如 Gemini3-Pro-High 和 GPT-5.2-Xhigh)已有效消解了这一安全壁垒,在复杂逻辑谜题(如“Bingo”)上取得最高 90% 的通过率。为应对这一挑战,我们提出了下一代 CAPTCHA—a 一个为下一代网络安全而设计的可扩展防御框架。不同于静态数据集,本基准构建于稳健的数据生成管道之上,实现大规模且易于扩展的评估。对于后端支持的类型,系统能够生成实际上是无限生成的 CAPTCHA 实例。我们利用持久存在的人类-人工智能“认知差异”,在交互式感知、记忆、决策和行动等方面。通过工程化需要适应直觉而非细粒度规划的动态任务,我们重新建立了生物用户与人工智能体之间的稳健区分,为智能体时代提供了一个可扩展且多样化的防御机制。
引用
@article{arxiv.2602.09012,
title = {Next-Gen CAPTCHAs: Leveraging the Cognitive Gap for Scalable and Diverse GUI-Agent Defense},
author = {Jiacheng Liu and Yaxin Luo and Jiacheng Cui and Xinyi Shang and Xiaohan Zhao and Zhiqiang Shen},
journal= {arXiv preprint arXiv:2602.09012},
year = {2026}
}
备注
Project page at https://greenoso.github.io/NextGen-CAPTCHAs_webpage/