通过基于上下文的聚合实现情境道德价值对齐
人工智能
2024-03-20 v1 计算与语言
摘要
开发价值对齐的 AI 智能体是一项复杂的任务,也是 AI 领域面临的持续挑战。特别是在大型语言模型领域,将多个独立训练的对话智能体(每个对齐于不同的道德价值)整合为一个能够适应并对齐多种道德价值的统一系统的能力至关重要。在本文中,我们提出了一种基于上下文聚合进行情境道德价值对齐的系统。此处,聚合被定义为整合 LLMs 响应子集的过程,该子集最适合响应用户输入,同时考虑从用户输入中提取的特征。所提出的系统在与人类价值的对齐方面,相比现有技术展现出了更好的结果。
引用
@article{arxiv.2403.12805,
title = {Contextual Moral Value Alignment Through Context-Based Aggregation},
author = {Pierre Dognin and Jesus Rios and Ronny Luss and Inkit Padhi and Matthew D Riemer and Miao Liu and Prasanna Sattigeri and Manish Nagireddy and Kush R. Varshney and Djallel Bouneffouf},
journal= {arXiv preprint arXiv:2403.12805},
year = {2024}
}