合成情感与意识:探索架构边界
人工智能
2026-03-05 v3 计算机与社会
摘要
随着人工代理展现出日益复杂的情感类行为,评估此类系统是否存在实例化意识风险的框架仍然有限。本文探讨了是否可以在刻意排除主要理论所关联的访问类意识架构特征的情况下,实现合成情感类控制。我们提出了一套用于分层、双源实现的架构原则(A1-A8),其中(i)即时需求产生动机信号,(ii)情景记忆提供来自相似过去情境的情感指导;这两个来源汇聚以调节行动选择。为了操作化意识相关风险,我们将主要理论的预测提炼为四项工程风险降低约束:(R1)无内容通用的、工作空间式的全局广播,(R2)无元表征,(R3)无自传体巩固,以及(R4)有界学习。我们探讨了三个问题:(Q1)情感类控制能否满足 R1-R4?我们呈现一个具体架构作为存在性证明。(Q2)该架构能否在不引入访问使能特征的情况下进行扩展?我们识别出保持合规性的稳定修改。(Q3)我们能否追踪可能增加访问风险的分级路径?我们绘制了逐步违反约束的渐进式转变。我们的贡献体现在三个层面:在工程层面,我们提出了一个模块化、受生物学启发的控制架构;在理论层面,我们提出了一个情感控制模型和一个将意识相关问题转化为可审计架构测试的方法论模板;在安全层面,我们勾勒了初步的审计指标,这些指标可能为未来的治理框架提供信息。该架构可独立作为情感类控制器运行,而风险降低标准可扩展至其他人工智能系统。
引用
@article{arxiv.2505.01462,
title = {Synthetic emotions and consciousness: exploring architectural boundaries},
author = {Hermann Borotschnig},
journal= {arXiv preprint arXiv:2505.01462},
year = {2026}
}
备注
34 pages, 2 tables, 1 figure. AI & Soc (2026)