从模型训练到模型抚养
人工智能
2025-11-18 v2 计算机与社会
机器学习
摘要
当前的 AI 训练方法仅在模型核心能力建立之后才与人类价值对齐,导致模型容易偏离且缺乏深层次的价值体系。我们提出了从"模型训练"向"模型抚养"的范式转变,在此范式下,价值观从一开始就嵌入模型的开发中。我们确定了这个范式的几个关键组件,所有组件都围绕重新设计训练语料库:将训练数据从第一人称视角重新阐述,将信息重新置于生活经验的语境中,模拟社交互动,以及对训练数据的排序进行脚手架化。我们预期,这种对训练语料库的重新设计将导致从首个训练标记开始就对价值观的承诺,使得知识、技能和价值观难以分割。对于能力在许多任务上超过人类能力的大型语言模型生态系统,本文认为这是一个关键需求。
引用
@article{arxiv.2511.09287,
title = {From Model Training to Model Raising},
author = {Roland Aydin and Christian Cyron and Steve Bachelor and Ashton Anderson and Robert West},
journal= {arXiv preprint arXiv:2511.09287},
year = {2025}
}
备注
Accepted for publication in Communications of the ACM (CACM), Opinion section