“先思考,后验证”:训练面对AI风险的个人
人机交互
2025-08-07 v1 人工智能
密码学与安全
计算机与社会
摘要
人工智能 enables unprecedented attacks on human cognition,而网络安全仍主要以设备为中心。本文引入“Think First, Verify Always”(TFVA)协议,将人类定位为“防火墙零号”,作为AI enabled威胁的第一道防线。该协议建立在五大运营原则之上:意识、完整性、判断、伦理责任和透明度(AIJET)。随机对照试验(n=151)显示,仅3分钟的干预即可产生显著的认知安全任务绩效提升,受试者表现出绝对+7.87%的提升。这些结果表明,简短的、基于原则的培训可快速增强人类对AI驱动认知操纵的韧性。我们建议GenAI平台将“Think First, Verify Always”作为标准提示嵌入,以取代被动警告,提供可操作的协议以增强可信赖和伦理的AI使用。通过搭建技术网络安全与人因工程之间的鸿沟,TFVA协议确立了以人类为中心的安全作为可信赖AI系统的关键组成部分。
引用
@article{arxiv.2508.03714,
title = {"Think First, Verify Always": Training Humans to Face AI Risks},
author = {Yuksel Aydin},
journal= {arXiv preprint arXiv:2508.03714},
year = {2025}
}